Hive_内部排序(Sort By)

Hive_内部排序(Sort By)
每个MapReduce内部排序（Sort By）

Sort By：对于大规模的数据集order by的效率非常低。在很多情况下，并不需要全局排序，此时可以使用sort by。

Sort by为每个reducer产生一个排序文件。每个Reducer内部进行排序，对全局结果集来说不是排序。

1．设置reduce个数
```
hive (default)> set mapreduce.job.reduces=3;
```
2．查看设置reduce个数
```
hive (default)> set mapreduce.job.reduces;
```
3．根据部门编号降序查看员工信息
```
hive (default)> select * from emp sort by deptno desc;
```
4．将查询结果导入到文件中（按照部门编号降序排序）
```
hive (default)> insert overwrite local directory '/opt/module/datas/sortby-result'
select * from emp sort by d
```
学习中，博客都是自己学习用的笔记，持续更新改正。。。
相关阅读:
Java读取文件方法和给文件追加内容
 Java中String类的format方法使用总结
 Java时间戳与日期格式字符串的互转
 Eclipse遇到Initializing Java Tooling解决办法
 CSS的总结(选择器,伪类等...)
Redis中的关系查询(范围查询,模糊查询等...)
Redis中文显示为Unicode编码的解决办法
 用bash命令得到Windows一个目录下的所有文件并且把结果输入到一个文件
 MapReduce按照两个字段对数据进行排序
 Scala中的抽象类
原文地址：https://www.cnblogs.com/Tunan-Ki/p/11808547.html