Hadoop Streaming 错误没有这样的文件或目录-6ren

Hadoop Streaming 错误没有这样的文件或目录

转载作者：可可西里更新时间：2023-11-01 15:28:53

28

4

我研究了 Hadoop，并使用 Ruby 测试了 Hadoop Streaming，看我的 MapReduce 算法是否可以正常工作。

所以，我执行了下一个命令。

hadoop jar hadoop-streaming-2.7.2.jar -files mapper.rb,reducer.rb -mapper mapper.rb -reducer reducer.rb -input test.json -output test

但是，下一个错误发生了。

dir/usercache/Kuma/appcache/application_1469093819516_0005/container_1469093819516_0005_01_000002/./mapper.rb": error=2, No such file or directory

此外，接下来是一项工作全部错误。

16/07/21 19:22:04 WARN util.NativeCodeLoader: Unable to load native-hadoop library for your platform... using builtin-java classes where applicable
packageJobJar: [/var/folders/l_/21nh6rmn6f3fn3vd55kh0b5h0000gn/T/hadoop-unjar8708804571112102348/] [] /var/folders/l_/21nh6rmn6f3fn3vd55kh0b5h0000gn/T/streamjob5933629893966751936.jar tmpDir=null
16/07/21 19:22:05 INFO client.RMProxy: Connecting to ResourceManager at localhost/127.0.0.1:8032
16/07/21 19:22:05 INFO client.RMProxy: Connecting to ResourceManager at localhost/127.0.0.1:8032
16/07/21 19:22:06 INFO mapred.FileInputFormat: Total input paths to process : 1
16/07/21 19:22:06 INFO mapreduce.JobSubmitter: number of splits:2
16/07/21 19:22:06 INFO mapreduce.JobSubmitter: Submitting tokens for job: job_1469093819516_0005
16/07/21 19:22:06 INFO impl.YarnClientImpl: Submitted application application_1469093819516_0005
16/07/21 19:22:06 INFO mapreduce.Job: The url to track the job: http://hatanokaoruakira-no-MacBook-Air.local:8088/proxy/application_1469093819516_0005/
16/07/21 19:22:06 INFO mapreduce.Job: Running job: job_1469093819516_0005
16/07/21 19:22:13 INFO mapreduce.Job: Job job_1469093819516_0005 running in uber mode : false
16/07/21 19:22:13 INFO mapreduce.Job:  map 0% reduce 0%
16/07/21 19:22:18 INFO mapreduce.Job: Task Id : attempt_1469093819516_0005_m_000000_0, Status : FAILED
Error: java.lang.RuntimeException: Error in configuring object
    at org.apache.hadoop.util.ReflectionUtils.setJobConf(ReflectionUtils.java:112)
    at org.apache.hadoop.util.ReflectionUtils.setConf(ReflectionUtils.java:78)
    at org.apache.hadoop.util.ReflectionUtils.newInstance(ReflectionUtils.java:136)
    at org.apache.hadoop.mapred.MapTask.runOldMapper(MapTask.java:449)
    at org.apache.hadoop.mapred.MapTask.run(MapTask.java:343)
    at org.apache.hadoop.mapred.YarnChild$2.run(YarnChild.java:164)
    at java.security.AccessController.doPrivileged(Native Method)
    at javax.security.auth.Subject.doAs(Subject.java:422)
    at org.apache.hadoop.security.UserGroupInformation.doAs(UserGroupInformation.java:1657)
    at org.apache.hadoop.mapred.YarnChild.main(YarnChild.java:158)
Caused by: java.lang.reflect.InvocationTargetException
    at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)
    at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62)
    at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)
    at java.lang.reflect.Method.invoke(Method.java:497)
    at org.apache.hadoop.util.ReflectionUtils.setJobConf(ReflectionUtils.java:109)
... 9 more
Caused by: java.lang.RuntimeException: Error in configuring object
    at org.apache.hadoop.util.ReflectionUtils.setJobConf(ReflectionUtils.java:112)
    at org.apache.hadoop.util.ReflectionUtils.setConf(ReflectionUtils.java:78)
    at org.apache.hadoop.util.ReflectionUtils.newInstance(ReflectionUtils.java:136)
    at org.apache.hadoop.mapred.MapRunner.configure(MapRunner.java:38)
... 14 more
Caused by: java.lang.reflect.InvocationTargetException
    at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)
    at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62)
    at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)
    at java.lang.reflect.Method.invoke(Method.java:497)
    at org.apache.hadoop.util.ReflectionUtils.setJobConf(ReflectionUtils.java:109)
... 17 more
Caused by: java.lang.RuntimeException: configuration exception
    at org.apache.hadoop.streaming.PipeMapRed.configure(PipeMapRed.java:222)
    at org.apache.hadoop.streaming.PipeMapper.configure(PipeMapper.java:66)
... 22 more
Caused by: java.io.IOException: Cannot run program "/private/tmp/hadoop-Kuma/nm-local-dir/usercache/Kuma/appcache/application_1469093819516_0005/container_1469093819516_0005_01_000002/./mapper.rb": error=2, No such file or directory
    at java.lang.ProcessBuilder.start(ProcessBuilder.java:1048)
    at org.apache.hadoop.streaming.PipeMapRed.configure(PipeMapRed.java:209)
    ... 23 more
Caused by: java.io.IOException: error=2, No such file or directory
    at java.lang.UNIXProcess.forkAndExec(Native Method)
    at java.lang.UNIXProcess.<init>(UNIXProcess.java:248)
    at java.lang.ProcessImpl.start(ProcessImpl.java:134)
    at java.lang.ProcessBuilder.start(ProcessBuilder.java:1029)
    ... 24 more

mapper.rb 和reducer.rb 存在于执行命令的当前目录中。用于测试的 wordcount MapReduce 运行没有错误，所以我认为 Hadoop 设置没问题。

环境
麦克埃尔卡皮坦
Hadoop 2.7.2(presudo分布式模式)

最佳答案

用 -files 选项指定的文件必须在 hdfs 中:

命令:

hadoop jar hadoop-streaming.jar -files f1.txt,f2.txt -input f1.txt -output test1

错误:

Input path does not exist: hdfs://quickstart.cloudera:8020/user/cloudera/f1.txt

将文件复制到 hdfs 后(在您的情况下，您需要复制到 hdfs 根目录 - (根据日志中的错误)):

hadoop fs -put f1.txt /user/cloudera
hadoop fs -put f2.txt /user/cloudera

作业运行没有错误:

[cloudera@quickstart hadoop-mapreduce]$ hadoop jar hadoop-streaming.jar -files f1.txt,f2.txt -input f1.txt -output test1
packageJobJar: [] [/usr/jars/hadoop-streaming-2.6.0-cdh5.7.0.jar] /tmp/streamjob5729321067745308196.jar tmpDir=null
16/07/23 11:36:16 INFO client.RMProxy: Connecting to ResourceManager at quickstart.cloudera/127.0.0.1:8032
16/07/23 11:36:17 INFO client.RMProxy: Connecting to ResourceManager at quickstart.cloudera/127.0.0.1:8032
16/07/23 11:36:18 INFO mapred.FileInputFormat: Total input paths to process : 1
16/07/23 11:36:18 INFO mapreduce.JobSubmitter: number of splits:1

HadoopStreaming - Making_Files_Available_to_Tasks:

-files 和-archives 选项允许您使文件和存档对任务可用。该参数是您已上传到 HDFS 的文件或存档的 URI。这些文件和文件跨作业缓存。您可以从 fs.default.name 配置变量中检索主机和 fs_port 值。

注意:-files 和 -archives 选项是通用选项。请务必将通用选项放在命令选项之前，否则命令将失败。

关于Hadoop Streaming 错误没有这样的文件或目录，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/38539166/

28

4

0

文章推荐： c++ - 好主意/坏主意我应该重新实现大部分 C++ 吗？

文章推荐： javascript - XHR 请求优先于图像？

文章推荐： python - 无法通过 http.client 正确重新连接

文章推荐： c++ - 是否有无锁 vector 实现？

目录
我正在为我的程序编写安装脚本，它应该在 Linux/Unix 操作系统上运行。以下文件的默认目录是什么: 可执行文件(程序)。程序应通过从命令行键入其名称来执行。共享库。第三方共享库(程序未开源，
asp.net-mvc - 将 AAD 从一个租户(目录)迁移到另一个租户(目录)
我有一堆用户、组和应用程序注册，我的 MVC 应用程序使用 AAD 数据进行身份验证和授权。是否可以将 Azure Active Directory 从一个租户(目录)迁移到另一个租户(目录)？如果可
clojure - lein-cljsbuild 源 cljs 目录 -> 输出 js 目录？
查看 cljsbuild 文档 https://github.com/emezeske/lein-cljsbuild :cljsbuild { :builds [{ ; The
svn利用TortoiseSVN忽略文件或文件夹(目录)
忽略已经版本控制的文件如果你不小心添加了一些应该被忽略的文件，你如何将它们从版本控制中去除而不会丢失它们？或许你有自己的IDE配置文件，不是项目的一部分，但将会花费很多时间使之按照自己的方式工作。
latex 目录？
我想使用\tableofcontents 命令，但没有目录从新页面开始或在末尾创建新页面，并且所有内容都是单倍行距。我怎样才能做到这一点？我假设使用 tocloft，但有哪些选择？谢谢最佳答案试
JavaScript 目录
我有一些 javascript 菜单代码，可以在单独的目录中正常工作。但是，当我尝试从同一目录中调用相同的 .js 文件时，它不会看到这些文件。以下内容来自另一个目录: script type="t
Python3列出与某个文件夹名称相同级别的所有文件/目录
我有这样的路径: /my/path/to/important_folder 在同一级别上，我还有其他文件和文件夹想要在达到与 important_folder 相同的级别时列出。我的文件夹可能更深，
Python如何获取文件路径/目录
1、获取文件路径实现 1.1 获取当前文件路径 ? 1
emacs 目录-局部变量问题
我正在使用最新版本的 NTEmacs。我写了一个名为“.dir-locals.el”的文件，如下所示。 ((nil . ((tab-width . 8) (fill-column .
Eclipse 的备忘单存储库/目录
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。想改善这个问题吗？更新问题，使其成为 on-topic对于堆栈溢出。 7年前关闭。 Improve thi
vim - 使用vim代码折叠标记生成索引(目录)
在我的 .vimrc 中有这些行 :set foldmethod=marker :set foldmarker=SECTION:,ENDSECTION: 用于自定义代码折叠。在我的文件中，相关语言的注
fish - 如何仅在fishshell中列出文件/目录？
在 fish 中: for x in * echo $x end *这里包括所有目录和文件，如何只列出文件(或目录)？最佳答案 fish 没有很多花哨的通配语法。但是，目录可以像这样迭代: f
Python 目录 hell
这是我的目录结构: ├── src │ ├── helpers │ │ ├── __init__.py │ │ ├── foo.py │ │ └── bar.py │
bash - 递归重命名文件夹/目录
我想递归重命名文件夹/目录名称并找到 this solution所以。但是这个命令没有效果 find . -type f -exec rename 's/old/new/' '{}' \; 这是一个正
iphone - 在相册中创建文件夹/目录
我想在相册中创建一个文件夹，并希望将图像保存在创建的相册中。这可能吗？有什么办法可以做到这一点吗？我已经搜索过，大多数人都说这是不可能的。感谢您的帮助。最佳答案您也许可以使用AssetsLi
python - 具有自定义名称的临时文件/目录？
如何在python中使用用户定义的名称创建临时文件/目录。我知道 tempfile .但是我看不到任何以文件名作为参数的函数。注意:我需要这个来对包含临时文件的临时目录上的 glob(文件名模式匹配
gradle - 从JaCoCo报告中删除特定的*目录*
我在项目中使用JaCoCo Gradle插件。作为问题的一个示例，我的大部分代码都在com.me.mysoftware包下。我正在使用代码生成器来生成build/generated/java/..
Gradle 找不到文件/目录
我正在尝试使用 Gradle 开始运行 jar 文件我的任务如下所示: task startServer(type: Exec) { workingDir file("${buildDir}/a
包含根目录的 Ant 目录
如何在 Ant 中定义一个目录集，其中包括两个目录:项目的基目录和子目录“test”？看起来您无法使用“/”、“.”或“”专门包含目录集的根目录。例如，这包括“./test”，但不包括“.”:
sublimetext2 - 项目查找器的设置是什么以避免搜索某些文件/目录？
我正在使用 CTAGs 包，它使用 Sublime Text 2 生成两个文件 .tags 和 .tags_sorted_by_file。那么当我进行项目搜索(CMD + SHIFT + F)时，如

首页

博学

6Ren·AI

商城

Hadoop Streaming 错误没有这样的文件或目录