- 1、本文档共6页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
hive基基础础数数据据库库操操作作以以及及分分区区、、动动态态分分区区、、分分桶桶
⼀、hive基础概念
1、Hive是什么
Hive是建⽴在Hadoop上的数据仓库基础构架。提供了⼀系列的⼯具,可以⽤来进⾏数据提取转化加载(ETL),这是⼀种可以存储、查询和分析存
储在Hadoop中的⼤规模数据的机制。Hive定义了简单的类SQL查询语⾔,称为HQL,允许熟悉SQL的⽤户查询数据。同时,这个语⾔
也允许熟悉MapReduce开发者的开发⾃定义的mapper和reducer来处理内建的mapper和reducer⽆法完成的复杂的分析⼯作。
Hive是SQL解析引擎,将SQL语句转译成M/RJob然后在Hadoop执⾏。
Hive的表其实就是HDFS的⽬录,按表名把⽂件夹分开。如果是分区表,则分区值是⼦⽂件夹,可以直接在M/RJob⾥使⽤这些数据。
Hive相当于hadoop的客户端⼯具,部署时不⼀定放在集群管理节点中,可以放在某个节点上
2、hive与传统数据库⽐较
3、Hive的存储格式
Hive的数据存储基于HadoopHDFS。
Hive没有专门的数据⽂件格式,常见的有以下⼏种。TEXTFLESEQUENCEFLEAVRORCFLEORCFLEPARQUET
4、Hive操作客户端
⼆、hive基础语法(hive基础语法与MySQL差不多)
1、建库,删库;
createdatabase库名;
切换test1数据库:
usetest1;
删库
DROPDATABASEFEXSTSycc;(删除空数据库)
DROPDATABASEFEXSTSyccCASCADE;(删除库之前清空库中表)
2、建表;
create[EXTERNAL]tablestudents
(
idbigint,
namestring,
ageintcomment,
genderstring,
clazzstring
)
PARTTONEDBY(⾮必选;创建分区表
dtstring)
clusteredby(userid)into3000buckets//⾮必选;分桶⼦
ROWFORMATDELMTEDFELDSTERMNATEDBY\t//必选;指定列之间的分隔符
STOREDASrcfile//⾮必选;指定⽂件的读取格式,默认textfile格式
location/testdata/;//⾮必选;指定⽂件在hdfs上的存储路径,如果已经有⽂件,会⾃动加载,默认在hive的warehouse下
CREATE[EXTERNAL]TABLE[FNOTEXSTS]table_name
//定义字段名,字段类型
[(col_namedata_type[COMMENTcol_comment],...)]
//给表加上注解
[COMMENTtable_comment]
//分区
[PARTTONEDBY(col_namedata_type[COMMENTcol_comment],...)]
//分桶
[CLUSTEREDBY(col_name,col_name,...)
//设置排序字段升序、降序
[SORTEDBY(col_name[ASC|DESC],...)]NTOnum_bucketsBUCKETS]
[
//指定设置⾏、列分隔符
[ROWFORMATrow_format]
//指定Hive储存格式:textFile、rcFile、SequenceFile默认为:textFile
[STOREDASfile_format]
|STOREDBYstorage.handler.class.name[WTHSERDEPR
文档评论(0)