Apache Hive是一个建立在Hadoop架构之上的数据仓库。它能够提供数据的精炼,查询和分析。Apache Hive起初由Facebook开发,目前也有其他公司使用和开发Apache Hive,例如Netflix等。亚马逊公司也开发了一个定制版本的Apache Hive,亚马逊网络服务包中的Amazon Elastic MapReduce包含了该定制版本。... 阅读全文
最喜欢哪些功能,好在哪里?操作接口采用类SQL语法,提供快速开发的能力(简单、容易上手)。避免了去写MapReduce,减少开发人员的学习成本。Hive的执行延迟比较高,因此Hive常用于数据分析,对实时性要求不高的场合。Hive优势在于处理大数据,对于处理小数据没有优势,因为Hive的执行延迟比较高。Hive支持用户自定义函数,用户可以根据自己的需求来实现自己的函数。不喜欢哪些功能,缺点或不足是什么?Hive的HQL表达能力有限。迭代式算法无法表达,数据挖掘方面不擅长,由于MapReduce数据处理流程的限制,效率更高的算法却无法实现。Hive的效率比较低。Hive自动生成的MapReduce作业,通常情况下不够智能化,Hive调优比较困难,粒度较粗。他解决了你的哪些问题?处理海量数据更便捷了