hadoop - Hadoop 2.7.2上的Pig-0.16.0-错误1002:无法存储别名-6ren

hadoop - Hadoop 2.7.2上的Pig-0.16.0-错误1002:无法存储别名

转载作者：行者123 更新时间：2023-12-02 21:17:22

我刚刚开始使用Pig学习，为此我在使用Pig版本0.16.0的Ubuntu 14.04 LTS上安装了伪分布式Hadoop 2.7.2。以下是我对PIG和Hadoop的配置-

文件:.bashrc

#===============================================================
# Hadoop Variable List

export JAVA_HOME=/usr/lib/jvm/java-9-oracle
export HADOOP_INSTALL=/home/hadoop/hadoop
export PATH=$PATH:$HADOOP_INSTALL/bin
export PATH=$PATH:$HADOOP_INSTALL/sbin
export HADOOP_MAPRED_HOME=$HADOOP_INSTALL
export HADOOP_COMMON_HOME=$HADOOP_INSTALL
export HADOOP_HDFS_HOME=$HADOOP_INSTALL
export HADOOP_HOME=$HADOOP_INSTALL
export YARN_HOME=$HADOOP_INSTALL
export HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_INSTALL/lib/native
export HADOOP_OPTS="-Djava.library.path=$HADOOP_INSTALL/lib/native"

#===============================================================
# PIG variable
export PIG_HOME="/home/hadoop/pig"
export PIG_INSTALL="$PIG_HOME"
export PIG_CONF_DIR="$PIG_HOME/conf"
export PIG_CLASSPATH="$HADOOP_INSTALL/conf"
export HADOOPDIR="$HADOOP_INSTALL/conf"
export PATH="$PIG_HOME/bin:$PATH"

=======================

以下是我执行Pig的目录

-rw-rw-r--  1 hadoop hadoop    540117 Jul 15 12:41 myfile.txt
hadoop@rajeev:~$ pwd
/home/hadoop

我也将此文件复制到HDFS

hadoop@rajeev:~$ hadoop fs -ls -R /user/hadoop
-rw-r--r--   1 hadoop supergroup     540117 2016-07-15 12:48 /user/hadoop/myfile.txt

现在...当我在Grunt shell中执行以下命令时，它会出错!

grunt> a = load 'myfile.txt' as line;
grunt> store a into 'c.out';

2016-07-15 12:56:38,670 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Processing aliases a
2016-07-15 12:56:38,670 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - detailed locations: M: a[1,4],a[-1,-1] C:  R: 
2016-07-15 12:56:38,684 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 0% complete
2016-07-15 12:56:38,685 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Running jobs are [job_1468556821972_0006]
2016-07-15 12:56:53,959 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 50% complete
2016-07-15 12:56:53,959 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Running jobs are [job_1468556821972_0006]
2016-07-15 12:57:25,722 [main] WARN  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Ooops! Some job has failed! Specify -stop_on_failure if you want Pig to stop immediately on failure.
2016-07-15 12:57:25,722 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - job job_1468556821972_0006 has failed! Stop running all dependent jobs
2016-07-15 12:57:25,722 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 100% complete
2016-07-15 12:57:25,726 [main] INFO  org.apache.hadoop.yarn.client.RMProxy - Connecting to ResourceManager at /0.0.0.0:8032
2016-07-15 12:57:25,786 [main] INFO  org.apache.hadoop.yarn.client.RMProxy - Connecting to ResourceManager at /0.0.0.0:8032
2016-07-15 12:57:25,839 [main] ERROR org.apache.pig.tools.pigstats.mapreduce.MRPigStatsUtil - 1 map reduce job(s) failed!
2016-07-15 12:57:25,841 [main] INFO  org.apache.pig.tools.pigstats.mapreduce.SimplePigStats - Script Statistics: 

HadoopVersion   PigVersion  UserId  StartedAt   FinishedAt  Features
2.7.2   0.16.0  hadoop  2016-07-15 12:56:36 2016-07-15 12:57:25 UNKNOWN

Failed!

Failed Jobs:
JobId   Alias   Feature Message Outputs
job_1468556821972_0006  a   MAP_ONLY    Message: Job failed!       hdfs://localhost:9001/user/hadoop/c.out,

Input(s):
Failed to read data from "hdfs://localhost:9001/user/hadoop/myfile.txt"

Output(s):
Failed to produce result in "hdfs://localhost:9001/user/hadoop/c.out"

Counters:
Total records written : 0
Total bytes written : 0
Spillable Memory Manager spill count : 0
Total bags proactively spilled: 0
Total records proactively spilled: 0

Job DAG:
job_1468556821972_0006


2016-07-15 12:57:25,842 [main] INFO    org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Failed!

我尝试通过其他方式解决该问题，方法是仅在本地模式下而不是在MapReduce模式下执行PIG，但似乎没有任何效果。每当这两个简单的命令失败时。

错误日志文件显示以下消息

2016-07-15 12:56:38,670 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Processing aliases a
2016-07-15 12:56:38,670 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - detailed locations: M: a[1,4],a[-1,-1] C:  R: 
2016-07-15 12:56:38,684 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 0% complete
2016-07-15 12:56:38,685 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Running jobs are [job_1468556821972_0006]
2016-07-15 12:56:53,959 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 50% complete
2016-07-15 12:56:53,959 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Running jobs are [job_1468556821972_0006]
2016-07-15 12:57:25,722 [main] WARN  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Ooops! Some job has failed! Specify -stop_on_failure if you want Pig to stop immediately on failure.
2016-07-15 12:57:25,722 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - job job_1468556821972_0006 has failed! Stop running all dependent jobs
2016-07-15 12:57:25,722 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - 100% complete
2016-07-15 12:57:25,726 [main] INFO  org.apache.hadoop.yarn.client.RMProxy - Connecting to ResourceManager at /0.0.0.0:8032
2016-07-15 12:57:25,786 [main] INFO  org.apache.hadoop.yarn.client.RMProxy - Connecting to ResourceManager at /0.0.0.0:8032
2016-07-15 12:57:25,839 [main] ERROR org.apache.pig.tools.pigstats.mapreduce.MRPigStatsUtil - 1 map reduce job(s) failed!
2016-07-15 12:57:25,841 [main] INFO  org.apache.pig.tools.pigstats.mapreduce.SimplePigStats - Script Statistics: 

HadoopVersion   PigVersion  UserId  StartedAt   FinishedAt  Features
2.7.2   0.16.0  hadoop  2016-07-15 12:56:36 2016-07-15 12:57:25 UNKNOWN

Failed!

Failed Jobs:
JobId   Alias   Feature Message Outputs
job_1468556821972_0006  a   MAP_ONLY    Message: Job failed!     hdfs://localhost:9001/user/hadoop/c.out,

Input(s):
Failed to read data from "hdfs://localhost:9001/user/hadoop/myfile.txt"

Output(s):
Failed to produce result in "hdfs://localhost:9001/user/hadoop/c.out"

Counters:
Total records written : 0
Total bytes written : 0
Spillable Memory Manager spill count : 0
Total bags proactively spilled: 0
Total records proactively spilled: 0

Job DAG:
job_1468556821972_0006


2016-07-15 12:57:25,842 [main] INFO  org.apache.pig.backend.hadoop.executionengine.mapReduceLayer.MapReduceLauncher - Failed!

请求您的帮助!

最佳答案

指定要加载到的字段的完整路径和数据类型。

a = load 'hdfs://localhost:9001/user/hadoop/myfile.txt' AS (line:chararray);
store a into 'hdfs://localhost:9001/user/hadoop/c.out';

关于hadoop - Hadoop 2.7.2上的Pig-0.16.0-错误1002:无法存储别名，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/38391061/

文章推荐： java - 迭代 MapReduce (Twister) 运行异常

文章推荐： php - 通过php访问docker容器内的文件

文章推荐： hadoop - Apache Phoenix中的Hbase过滤器

apache-pig - 在嵌入式 pig 程序中执行具有多个商店的 pig 脚本文件
我想在嵌入式 pig 程序中执行一个 pig 脚本文件，如下所示 ----testPig.pig----- A = load '/user/biadmin/student' using PigStor
apache-pig - Pig - 如何将日期时间转换为字符数组
我正在使用 CurrentTime()，它是一种日期时间数据类型。但是，我需要它作为字符数组。我有以下几点: A = LOAD ... B = FOREACH A GENERATE CurrentTi
apache-pig - pig 在色调内不可见
我有一个 hadoop 集群。安装了 pig : 但是在 Hue (3.7) 中看不到 Pig 编辑器: 我该如何解决？最佳答案你能检查一下你的hue.ini文件吗在解释器部分，如下图 # O
apache-pig - Pig - 日期字符串到长转换
我在源文本文件中有一些日期值，如下面的第 3 列 123|text|2000-02-05 01:00:00-0500|true 如何将它们转换为 Pig 拉丁语中相应的 long 值？谢谢。 a =
apache-pig - pig 转储不能带表情？
看来我做不到 dump (limit A 10); 尽管 B = limit A 10; dump B; 似乎工作。为什么？这似乎违反直觉。最佳答案确实是你不能这样做。我相信为什么的问题不在范
apache-pig - pig -如何在JOIN之后引用FOREACH中的列？
A = load 'a.txt' as (id, a1); B = load 'b.txt as (id, b1); C = join A by id, B by id; D = foreach C
apache-pig - pig 储存条件
假设我有一个输入文件作为 map 。 sample.txt [1#"anything",2#"something",3#"anotherthing"] [2#"kish"] [3#"mad"] [4#
apache-pig - PIG 减去两个日期
我正在尝试用 PIG 减去两个日期。我有这样的数据: key_one, activation_date , deactivation_date (1456,2010-06-14 00:00:00,2
apache-pig - Pig - 加载具有不同架构的多个文件
我正在与 pig 一起加载以逗号分隔的文件/文件夹 hadoop 范围。( this question on how to load multiple files in pig 问题是每个文件夹都有不
apache-pig - pig 的双引号和单引号有什么区别？
我一直认为 '' 和 "" 在 pig 中是一样的，但今天我得到了 Unexpected character '"' 出错 register datafu-pig-1.2.1.jar define C
java - Apache Pig : unable to run my own pig. jar 和 pig-withouthadoop.jar
我有一个运行 Hadoop 0.20.2 和 Pig 0.10 的集群。我有兴趣向 Pig 的源代码添加一些日志，并在集群上运行我自己的 Pig 版本。我做了什么: 使用'ant'命令构建项目得到
apache-pig - 更改为 Pig 版本 0.10.0 导致的 Apache Pig 错误 2218
我无能为力地试图解决这个问题。我的脚本和 UDF 可以在 Pig 0.8.1 上完美运行，但是当我尝试在 Pig 0.10.0 上运行时，我得到: ERROR org.apache.pig.tools
hadoop - 执行 Pig 脚本 -x local script.pig 和 just script.pig 之间的区别
目前我正在执行我的脚本: /usr/bin/pig /somepath/myscript.pig 出于某种原因，pig 总是卡在这个阶段。 2014-01-28 16:49:31,328 [main]
apache-pig - 无法删除 Pig 中的特殊字符
我有一个要加载到 Pig Engine 上的文本文件，文本文件在单独的行中有名称，数据但有错误......特殊字符......像这样: Ja@@$s000on J@@a%^ke T!!ina M
apache-pig - 我可以在 pig 的多个列上做不同的处理吗？
我有一个用例，我需要计算两个字段的不同数量。 sample : x = LOAD 'testdata' using PigStorage('^A') as (a,b,c,d); y = GROUP x
apache-pig - 使用 pig，如何将混合格式行解析为元组和一袋元组？
我是 Pig 的新手，在解析我的输入并将其转换为我可以使用的格式时遇到了问题。输入文件包含具有固定字段和 KV 对的行，如下所示: FF1|FF2|FF3|FF4|KVP1|KVP2|...|KVPn
apache-pig - 如何使用 PIG 加载文件夹中的每个文件？
我有一个每天创建的文件文件夹，所有文件都存储相同类型的信息。我想制作一个脚本，加载最新的 10 个，将它们联合起来，然后在它们上运行一些其他代码。由于 pig 已经有一个 ls 方法，我想知道是否有一
apache-pig - Apache Pig rank函数的使用
我正在使用 Pig 0.11.0 排名函数并为我的数据中的每个 id 生成排名。我需要以特定方式对我的数据进行排名。我希望每个新 ID 的排名都重置并从 1 开始。是否可以直接使用 rank 函数
apache-pig - 在 Pig 中投影分组元组
我有一个 (t,a,b) 形式的元组集合，我想在 Pig 中按 b 对它们进行分组。一旦分组，我想从每组中的元组中过滤出 b 并为每组生成一袋过滤后的元组。例如，假设我们有 (1,2,1) (2,0
apache-pig - pig : how to exit on failure?
-- do something store result into '$RESULT.tmp'; rmf $RESULT mv $RESULT.tmp $RESULT 如果在 rmf $RESULT

行者123

个人简介

我是一名优秀的程序员,十分优秀！

作者热门文章

滴滴打车优惠券免费领取

全站热门文章

首页

博学

6Ren·AI

商城

hadoop - Hadoop 2.7.2上的Pig-0.16.0-错误1002:无法存储别名