- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
我在 MySQL 数据库中有两个表,分别称为“游戏”和“团队”。它们具有以下形式:
game:
+-----+------+
| gid | temp |
+-----+------+
| 1 | 79 |
| 2 | 78 |
| 3 | 109 |
| 4 | 77 |
| 5 | 90 |
| 6 | 89 |
| 7 | 65 |
| 8 | 71 |
| 9 | 89 |
| 10 | 80 |
+-----+------+
team:
+-----+-------+-----+-----+
| gid | tname | ry | py |
+-----+-------+-----+-----+
| 1 | SF | 92 | 247 |
| 1 | ATL | 95 | 264 |
| 2 | JAC | 119 | 279 |
| 2 | CLE | 96 | 153 |
| 3 | PHI | 306 | 119 |
| 3 | DAL | 67 | 100 |
| 4 | NYJ | 118 | 261 |
| 4 | GB | 62 | 149 |
| 5 | IND | 119 | 267 |
| 5 | KC | 74 | 206 |
+-----+-------+-----+-----+
还有更多的专栏,但这些是相关的。我已经使用 Sqoop 将它们导出到 Hive(我以伪分布式模式运行),并且我正在尝试运行一个简单的查询;但是,与在 MySQL 中运行相同的查询相比,我得到的结果大不相同。
例如,如果我在 Hive 中运行查询(以获取在低于冰点的温度下每场比赛的平均码数)
SELECT tname, AVG(ry+py) as ypg FROM team INNER JOIN
(SELECT gid FROM game WHERE temp<=32) AS cold
ON team.gid=cold.gid GROUP BY tname;
我明白了
OK
ARI 263.0
ATL 271.5
BAL 309.77777777777777
BUF 304.5
CAR 278.6666666666667
CHI 292.6333333333333
CIN 309.77272727272725
CLE 290.6666666666667
DAL 255.85714285714286
DEN 366.5
DET 327.44444444444446
GB 373.75471698113205
HOU 391.75
IND 303.9
JAC 302.0
KC 346.4782608695652
MIA 325.1666666666667
MIN 325.6666666666667
NE 358.5
NO 369.3333333333333
NYG 347.57142857142856
NYJ 310.27777777777777
OAK 326.7
PHI 344.3
PIT 359.969696969697
SD 337.14285714285717
SEA 289.45454545454544
SF 340.14285714285717
STL 452.0
TB 348.3333333333333
TEN 305.3076923076923
WAS 290.3333333333333
Time taken: 30.172 seconds, Fetched: 32 row(s)
然而,在 MySQL 中运行相同的查询会得到
+-------+----------+
| tname | ypg |
+-------+----------+
| ARI | 339.7283 |
| ATL | 347.1628 |
| BAL | 304.5625 |
| BUF | 305.1250 |
| CAR | 333.7179 |
| CHI | 313.3462 |
| CIN | 316.9167 |
| CLE | 301.1579 |
| DAL | 356.4805 |
| DEN | 357.8298 |
| DET | 366.3509 |
| GB | 372.9351 |
| HOU | 334.9915 |
| IND | 362.3732 |
| JAC | 325.9444 |
| KC | 339.1622 |
| MIA | 318.6667 |
| MIN | 341.0000 |
| NE | 368.5614 |
| NO | 408.4219 |
| NYG | 370.2500 |
| NYJ | 314.8788 |
| OAK | 327.7143 |
| PHI | 354.2619 |
| PIT | 359.4565 |
| SD | 352.2105 |
| SEA | 349.8444 |
| SF | 320.9744 |
| STL | 348.1736 |
| TB | 309.9310 |
| TEN | 314.4222 |
| WAS | 362.3548 |
+-------+----------+
32 rows in set (0.00 sec)
为什么这些不同?
最佳答案
事实证明,Hive 查询返回了正确的结果。这是因为“游戏”表中缺少一些温度,MySQL 将其视为 0(因此在低于冰点的温度下计算每场比赛的码数)。
关于mysql - Hive 查询给出与 SQL 不同的结果,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/37599470/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!