gpt4 book ai didi

sorting - 排序(Order by)在Hive中是如何实现的?

转载 作者:可可西里 更新时间:2023-11-01 16:20:14 26 4
gpt4 key购买 nike

我们知道hive在排序作业开始之前不做采样,它只是利用MapReduce的排序机制,在reduce端进行merge-sort,只使用一个reduce,因为reduce收集mapper输出的所有数据在这种情况下,假设一台运行 reduce 的机器只有 100GB 的磁盘,如果数据太大而无法放入磁盘怎么办?

最佳答案

Hive的并行排序机制还在开发中,见here .

设计良好的数据仓库或数据库应用程序将避免这种全局排序。如果需要,请尝试使用 Pig或 Terasort(http://hadoop.apache.org/common/docs/current/api/org/apache/hadoop/examples/terasort/package-summary.html)

关于sorting - 排序(Order by)在Hive中是如何实现的?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/9476568/

26 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com