Hive 和 HBase区别

作者：yuan daisy
链接：https://www.zhihu.com/question/21677041/answer/78289309
来源：知乎
著作权归作者所有。商业转载请联系作者获得授权，非商业转载请注明出处。

   Hive中的表是纯逻辑表，就只是表的定义等，即表的元数据。Hive本身不存储数据，它完全依赖HDFS和MapReduce。这样就可以将结构化的数据文件映射为为一张数据库表，并提供完整的SQL查询功能，并将SQL语句最终转换为MapReduce任务进行运行。 而HBase表是物理表，适合存放非结构化的数据。2.      Hive是基于MapReduce来处理数据,而MapReduce处理数据是基于行的模式；HBase处理数据是基于列的而不是基于行的模式，适合海量数据的随机访问。3.      HBase的表是疏松的存储的，因此用户可以给行定义各种不同的列；而Hive表是稠密型，即定义多少列，每一行有存储固定列数的数据。4.      Hive使用Hadoop来分析处理数据，而Hadoop系统是批处理系统，因此不能保证处理的低迟延问题；而HBase是近实时系统，支持实时查询。5.      Hive不提供row-level的更新，它适用于大量append-only数据集（如日志）的批任务处理。而基于HBase的查询，支持和row-level的更新。6.      Hive提供完整的SQL实现，通常被用来做一些基于历史数据的挖掘、分析。而HBase不适用与有join，多级索引，表关系复杂的应用场景。

评论：
Hive中的表是纯逻辑表有误，HIve 默认有自己的物理表，即managed table；如果要纯逻辑表，那就要声明创建为external table.

联机事务处理和联机分析处理

http://blog.csdn.net/terryzero/article/details/3982056

http://blog.csdn.net/canba/article/details/7492100

相关阅读:
谈一谈循环的性能提升
Web前端性能优化的9大问题
随机获取一种颜色值的三种方法
ES6还是ES2015？
history.back(-1)和history.go(-1)的区别
关于overflow-y:scroll ios设备不流畅的问题
前端如何压缩图片
【转】理解JavaScript之闭包
关于如何给数字排序
本地缓存localstorage使用

原文地址：https://www.cnblogs.com/jijizhazha/p/7657181.html