`
cakin24
  • 浏览: 1384240 次
  • 性别: Icon_minigender_1
  • 来自: 西安
社区版块
存档分类
最新评论

什么是Hive

    博客分类:
  • Hive
阅读更多
一 什么是Hive
1、Hive是构建于Hadoop HDFS之上的一个数据仓库基础架构。
2、Hive可以用来进行数据提取转化加载(ETL)。
3、Hive定义了简单的类似SQL查询语言,称为HQL,它允许熟悉SQL的用户查询数据。
4、Hive允许熟悉MapReduce开发者开发自定义的mapper和reducer来处理内建的mapper和reducer无法完成的复杂的分析工作。
5、Hive是HQL解析引擎,他将SQL语句转移成M/R Job,然后在Hadoop执行。
6、Hive的表其实就是HDFS的目录/文件。
 
二 Hive的元数据
1、Hive将元数据存储在数据库中(metastore),支持mysql、derby等数据库。derby是默认数据库。
2、Hive中的元数据包括表的名字,表的列和分区及其属性,表的属性(是否为外部表等),表的数据所在目录等。


 

 

 
  • 大小: 112.2 KB
分享到:
评论

相关推荐

Global site tag (gtag.js) - Google Analytics