• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >云计算 > hive创建表语句详解,hive语句详解

hive创建表语句详解,hive语句详解

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含hive详解,hive创建表语句,hive建表语句,hive查询语句,hive 循环语句等服务器相关知识,网友希望可以进行参考

hive创建表语句详解,hive语句详解


创建表的语句:
Create [EXTERNAL] TABLE [IF NOT EXISTS] table_name 
[(col_name data_type [COMMENT col_comment], ...)] 
[COMMENT table_comment] 
[PARTITIONED BY (col_name data_type [COMMENT col_comment], ...)] 
[CLUSTERED BY (col_name, col_name, ...) [SORTED BY (col_name [ASC|DESC],...)]INTO num_buckets BUCKETS]
[ROW FORMAT row_format] 
[STORED AS file_format] 
[LOCATION hdfs_path]

CREATE TABLE 
创建一个指定名字的表。如果相同名字的表已经存在,则抛出异常;用户可以用 IF NOT EXIST 选项来忽略这个异常。
EXTERNAL 
关键字可以让用户创建一个外部表,在建表的同时指定一个指向实际数据的路径(LOCATION),Hive创建内部表时,会将数据移动到数据仓库指向的路径;若创建外部表,仅记录数据所在的路径,不对数据的位置做任何改变。在删除表的时候,内部表的元数据和数据会被一起删除,而外部表只删除元数据,不删除数据。
如果文件数据是纯文本,可以使用 STORED AS TEXTFILE。如果数据需要压缩,使用 STORED AS SEQUENCE 。
有分区的表可以在创建的时候使用 PARTITIONED BY 语句。一个表可以拥有一个或者多个分区,每一个分区单独存在一个目录下。而且,表和分区都可以对某个列进行 CLUSTERED BY 操作,将若干个列放入一个桶(bucket)中。也可以利用SORT BY 对数据进行排序。这样可以为特定应用提高性能。



创建普通的表:
create table test_table (

id int,

name string,

no int) 

row formatdelimited 

fieldsterminated by ',' 

stored astextfile;//
指定了字段的分隔符,hive只支持单个字符的分隔符。hive默认的分隔符是\001



创建带有partition的表:
create table test_partition (

id int,

name string,

no int)

partitioned by(dt string) 

row formatdelimited 

fieldsterminated by ',' 

stored astextfile;


load data local inpath '/home/zhangxin/hive/test_hive.txt' overwrite intotabletest_partition partition (dt='2012-03-05');



创建带有Bucket的表:
create table test_bucket (

id int,

name string,

no int)

partitioned by(dt string) 

clustered by(id) into 10 buckets --
将id这一列分到10个桶中。

row formatdelimited 

fieldsterminated by ',' 

stored astextfile;

关于分桶:对列进行分桶,本质上,在进行reduce的时候,会对列的值进行hash,然后将hash的值放到特定的桶中(有点像distribute by)。

注意在写入分桶数据的时候,需要指定:

sethive.enforce.bucketing=true;



创建external表:
create external table test_external (

id int,

name string,

no int)

row formatdelimited 

fieldsterminated by ',' 

location'/home/zhangxin/hive/test_hive.txt';


创建与已知表相同结构的表Like:

只复制表的结构,而不复制表的内容。
create table test_like_table like test_bucket;

更多精彩内容请关注:http://bbs.superwu.cn

关注超人学院微信二维码:

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • hive创建表语句详解,hive语句详解

相关文章

  • Spark MLlib Deep Learning Convolution Neural Network (深度学习-卷积神经网络)3.1,mllibconvolution
  • linux screen 使用方法,linuxscreen
  • 机器学习--Logistic回归算法案例,--logistic算法
  • HDFS概述---namenode的设计详解,hdfs概述---namenode
  • Greenplum+Hadoop学习笔记-14-定义数据库对象之创建与管理序列、索引以及视图,hadoop-14-
  • hive的变量传递设置,hive变量传递设置
  • 一篇博文简单了解weka,博文简单weka
  • MapReduce编程之实现多表关联,mapreduce编程关联
  • Spark MLlib Deep Learning Deep Belief Network (深度学习-深度信念网络)2.1,mllibbelief
  • Hbase:namespace异常处理,hbase异常处理

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • mongodb基础操作,mongodb基础
    • 讨论Spark的配置监控和性能优化,spark监控性能优化
    • Twitter 新一代流处理利器——Heron 论文笔记之Storm Limitations,
    • 几本京东上的CISCO云计算相关书籍,cisco相关书籍
    • Linux系统只能连上内网不能够连上外网。Unit network.service entered failed state.,外网访问内网服务器
    • Hadoop向HDFS写入、删除、读取文件,
    • 如何解决Greenplum中无法通过标准命令修复的元数据错误,greenplum元数据
    • LXC学习,学习中国app上线
    • Xen安全架构sHype/ACM和XSM/Flask的相关网络资源,xenshype
    • 【HBase】how many zookeepers should i run?,hbasezookeepers

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有