java - 在 Hadoop 作业中输出键类或值类是强制性的还是可选的？-6ren

java - 在 Hadoop 作业中输出键类或值类是强制性的还是可选的？

转载作者：可可西里更新时间：2023-11-01 16:32:05

26

4

在 Java 中的单类 MapReduce 作业中，我是否必须设置输出键类或值类，或者它是可选的，如果未设置则有某种默认值适用？例如，如果我在我的工作中注释掉以下内容，它似乎运行良好，但我只是想确认我没有遗漏任何东西。

有问题的行要注释掉...

//job.setOutputKeyClass(Text.class);
//job.setOutputValueClass(IntWritable.class);

示例数据文件，我用逗号分隔并首先拉入最后一列...

600000US00601,00601,"00601 5-Digit ZCTA; 006 3-Digit ZCTA",11102
8600000US00602,00602,"00602 5-Digit ZCTA; 006 3-Digit ZCTA",12869
8600000US00603,00603,"00603 5-Digit ZCTA; 006 3-Digit ZCTA",12423
8600000US00604,00604,"00604 5-Digit ZCTA; 006 3-Digit ZCTA",33548

最佳答案

来自 Hadoop 权威指南 [Ed 3rd/ch 7.3]:

Text Output
The default output format, TextOutputFormat, writes records as lines of text. Its keys 
and values may be of any type, since TextOutputFormat turns them to strings by calling 
toString() on them. Each key-value pair is separated by a tab character, although that 
may be changed using the mapred.textoutputformat.separator property.

它指出 TextOutputFormat 在输出时对键和值调用 toString() ，因此可以接受任何类型。因此，我认为在不指定您提到的行的情况下运行简单的 MR 作业不会产生任何问题。

但是，当您明确指定另一种输出格式时，肯定会产生问题，例如 SimpleDBOutpFormat。

关于java - 在 Hadoop 作业中输出键类或值类是强制性的还是可选的？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/26037871/

26

4

0

文章推荐： c++ - 在 Visual Studio 中使用 64 位编译器

文章推荐： python - 如何在 Python 中使用套接字响应 SSDP 搜索？

文章推荐： c++ - 为什么 unique_ptr operator* 不是 noexcept？

PHP - 使关联数组唯一，键 ->值和值 ->键
我在 php 方面遇到了一个小问题，我发现很难用语言来解释。我有一个包含键值的关联数组。我想制作一个函数(或者如果已经有一个函数)，它将一个数组作为输入并删除重复项，但两种方式都是如此。例如: 在我
c# - Winforms App (C#) 中的 Windows 键 + [键] 快捷方式
我有一个在系统托盘中运行的应用程序，是否可以允许用户通过 C# 中的 Windows 键 + 键恢复该应用程序？谢谢最佳答案是的，使用 Windows API。我认为 Windows 键与 C
mysql - findOne({键 :value}) or findOne(). 其中({键 :value}) when querying database with waterline?
我正在使用 Waterline通过 Sails 查询 MySQL 数据库。我找到了 2 种方法。不知道哪个更好？顺便问一下，如何处理这两种情况的错误？ 1. Model.findOne().whe
C# 键枚举混淆 : Keys. Alt 或 Keys.RButton |键.ShiftKey |键.Alt
我正在尝试测试是否按下了 Alt 键。我的支票类似于: private void ProcessCmdKey(Keys keyData) { if (keyData == Keys.Alt) {
ruby - 按 TAB 键，然后在带有 Ruby 的 Selenium WebDriver 中按 ENTER 键
我正在使用 Selenium WebDriver 和 Ruby 进行自动化测试。我需要点击一个按钮。我无法通过 id 或 css 或 xpath 获取按钮元素，因为按钮是透明的。我想使用 Tab 和
ide - 什么是⎋键
我是 IntelliJ 的新手，我看到一个启动提示说，“任何工具窗口中的 ⎋ 键都会将焦点移动到编辑器。”但是，我不知道⎋键是什么。我一直在编程很长时间。我的键盘上可能有一个我多年来一直错过的键吗？
javascript - 每次用户单击输入中的空格键时如何添加 + 键
我使用 OMDB API 创建了一个电影搜索页面。我遇到的问题是，如果我搜索一部包含多个单词的电影，此 API 会出错，因为 API 的 URL 必须在 URL 中的每个单词之间有 + 键。所以我想知
名称为彼此子字符串的 Elasticsearch 键
我已经用 Elasticsearch 玩了大约一天了，所以我非常陌生。我正在尝试 POST/import 一个简单的文件: { "compression" : "none", "com
javascript - 键/值对的值也可以是键吗？
enter image description here 在此示例中，要记录带有“title”和“director”键的属性值，使用 obj[key]。因为我们已经处于对象的执行上下文中:在本例中是电
来自同一台机器的多个项目的开放类次的 ssh 键
我是新开类。我使用新的电子邮件 ID 和密码在 openshift 上创建了一个项目。让我们称之为 firstApp 。我做了 rhc 设置和我的 ssh key 与我的项目相关联。我的 frie
java - Jackson反序列化json字符串但bean缺少json字符串的属性/键
当我使用 Jackson 反序列化 json 字符串时，我通常不想创建所有 bean 类的属性，而且我只需要一些 json 字符串的字段，其他字段我不需要。所以我经常只在我需要的 java 类 bea
clojure - 键*/具有内联值规范的键
我想编写一个带有 keys/keys* 的规范，但能够内联值规范，但不支持 by design ，我明白了其背后的原因。然而，有时，本地图存在特定上下文时，您确实希望(或者只是通过遗留或第三方)键和值
perl - 键/值的分配顺序是什么？
my %fruit_colors = ("apple", "red", "banana", "yellow"); my @fruits = keys %fruit_colors; my @colors
DataGridView/Enter 键？
我正在使用 vb.net 2008 和 DataGridView。我正在寻找允许我将 enter 键移动到右侧的下一列而不是在保持在同一列时向下移动一行的代码。最佳答案如果您正在确认编辑，只需移动
javascript - 迭代对象属性/键
我刚刚开始学习编码，我遇到了这个我无法理解的问题。 “我们将添加的第二个函数称为搜索，它将以名字作为参数。它将尝试将收到的名字与我们 friend 联系人列表中的任何名字相匹配。如果它找到匹配项，就会
python - 改变Python中的字典/键
我已经在 Python 中运行了下面的代码，以从文本文件中生成单词列表及其计数。我该如何从“Frequency_list”变量中过滤掉计数为 1 的单词？另外，如何将底部的打印语句循环导出到CSV
XSLT 键()查找
我正在尝试 XSLT 中的查找表示例，但无法使其正常工作
javascript - 从对象返回访问的属性名(键)
是否可以在 Javascript/Typescript 中编写一个将参数名称/键作为字符串返回的函数？ function foo(arg) {...} let user = new User(); f
对象中未填充 Javascript 键
我正在尝试创建一个带有键/值的对象，但是当我看到该对象时，键没有正确填充.. 我希望键是 - 0,1,2,3 但它显示“索引”作为键。 > categories = ["09/07/2016 00:0
Android模拟器硬件键盘[Esc]键
将 Android Studio 从 1.5 升级到 2.0 后，模拟器(现在版本为 25.1.1，我在其上配置了模拟硬件键盘)不再将 [Esc] 键识别为等同于 [Back] 按钮。如何恢复这个有

首页

博学

6Ren·AI

商城

java - 在 Hadoop 作业中输出键类或值类是强制性的还是可选的？