• Hive_创建表


    1.建表语法

    CREATE [EXTERNAL] TABLE [IF NOT EXISTS] table_name 
    [(col_name data_type [COMMENT col_comment], ...)] 
    [COMMENT table_comment] 
    [PARTITIONED BY (col_name data_type [COMMENT col_comment], ...)] 
    [CLUSTERED BY (col_name, col_name, ...) 
    [SORTED BY (col_name [ASC|DESC], ...)] INTO num_buckets BUCKETS] 
    [ROW FORMAT row_format] 
    [STORED AS file_format] 
    [LOCATION hdfs_path]
    [TBLPROPERTIES (property_name=property_value, ...)]
    [AS select_statement]

    2.字段解释说明

    (1)CREATE TABLE 创建一个指定名字的表。如果相同名字的表已经存在,则抛出异常;用户可以用 IF NOT EXISTS 选项来忽略这个异常。

    (2)EXTERNAL关键字可以让用户创建一个外部表,在建表的同时可以指定一个指向实际数据的路径(LOCATION),在删除表的时候,内部表的元数据和数据会被一起删除,而外部表只删除元数据,不删除数据。

    (3)COMMENT:为表和列添加注释。

    (4)PARTITIONED BY创建分区表

    (5)CLUSTERED BY创建分桶表

    (6)SORTED BY不常用,对桶中的一个或多个列另外排序

    (7)ROW FORMAT

    DELIMITED [FIELDS TERMINATED BY char] [COLLECTION ITEMS TERMINATED BY char]
            [MAP KEYS TERMINATED BY char] [LINES TERMINATED BY char] 
       | SERDE serde_name [WITH SERDEPROPERTIES (property_name=property_value, property_name=property_value, ...)]

    用户在建表的时候可以自定义SerDe或者使用自带的SerDe。如果没有指定ROW FORMAT 或者ROW FORMAT DELIMITED,将会使用自带的SerDe。在建表的时候,用户还需要为表指定列,用户在指定表的列的同时也会指定自定义的SerDe,Hive通过SerDe确定表的具体的列的数据。

    SerDe是Serialize/Deserilize的简称, hive使用Serde进行行对象的序列与反序列化。

    (8)STORED AS指定存储文件类型

    常用的存储文件类型:SEQUENCEFILE(二进制序列文件)、TEXTFILE(文本)、RCFILE(列式存储格式文件)

    如果文件数据是纯文本,可以使用STORED AS TEXTFILE。如果数据需要压缩,使用 STORED AS SEQUENCEFILE。

    (9)LOCATION :指定表在HDFS上的存储位置。

    (10)AS:后跟查询语句,根据查询结果创建表。

    (11)LIKE允许用户复制现有的表结构,但是不复制数据。

    管理表

    1.理论

    默认创建的表都是所谓的管理表,有时也被称为内部表。因为这种表,Hive会(或多或少地)控制着数据的生命周期。Hive默认情况下会将这些表的数据存储在由配置项hive.metastore.warehouse.dir(例如,/user/hive/warehouse)所定义的目录的子目录下。 当我们删除一个管理表时,Hive也会删除这个表中数据。管理表不适合和其他工具共享数据。

    2.案例实操

    (1)普通创建表

    create table if not exists student2(
    id int, name string
    )
    row format delimited fields terminated by '	'
    stored as textfile
    location '/user/hive/warehouse/student2';

    (2)根据查询结果创建表(查询的结果会添加到新创建的表中)

    create table if not exists student3 as select id, name from student;

    (3)根据已经存在的表结构创建表

    create table if not exists student4 like student;

    (4)查询表的类型

    hive (default)> desc formatted student2;
    Table Type:             MANAGED_TABLE  

    外部表

    1.理论

    因为表是外部表,所以Hive并非认为其完全拥有这份数据。删除该表并不会删除掉这份数据,不过描述表的元数据信息会被删除掉。

    2.管理表和外部表的使用场景

    每天将收集到的网站日志定期流入HDFS文本文件。在外部表(原始日志表)的基础上做大量的统计分析,用到的中间表、结果表使用内部表存储,数据通过SELECT+INSERT进入内部表。

    3.案例实操

    分别创建部门和员工外部表,并向表中导入数据。

    (1)      上传数据到HDFS

    hive (default)> dfs -mkdir /student;
    hive (default)> dfs -put /opt/module/datas/student.txt /student;

    (2)建表语句

    hive (default)> create external table stu (
    id int, 
    name string) 
    row format delimited fields terminated by '	' 
    location '/student';

    (3)查看创建的表

    hive (default)> select * from stu_external;
    OK
    stu_external.id stu_external.name
    1001    lisi
    1002    wangwu
    1003    zhaoliu

    (4)查看表格式化数据

    hive (default)> desc formatted dept;
    Table Type:             EXTERNAL_TABLE

    (5)删除外部表

    hive (default)> drop table stu_external;

    外部表删除后,hdfs中的数据还在,但是metadata中stu_external的元数据已被删除

    管理表与外部表的互相转换

    (1)查询表的类型

    hive (default)> desc formatted student2;
    Table Type:             MANAGED_TABLE

    (2)修改内部表student2为外部表

    alter table student2 set tblproperties('EXTERNAL'='TRUE');

    (3)查询表的类型

    hive (default)> desc formatted student2;
    Table Type:             EXTERNAL_TABLE

    (4)修改外部表student2为内部表

    alter table student2 set tblproperties('EXTERNAL'='FALSE');

    (5)查询表的类型

    hive (default)> desc formatted student2;
    Table Type:             MANAGED_TABLE

    注意:('EXTERNAL'='TRUE')和('EXTERNAL'='FALSE')为固定写法,区分大小写!

    学习中,博客都是自己学习用的笔记,持续更新改正。。。
  • 相关阅读:
    poj2926
    poj2917
    新手入门:PHP网站开发中常见问题汇总
    js字符串转换成数字,数字转换成字符串
    !! jquery主要资料
    IT公司面试手册.htmhttp://www.mianwww.com/html/2009/02/2931.html
    sql语句 返回最后的insert操作所产生的自动增长的id
    eclipse 无法正常保存js
    javascript深入理解js闭包
    如何用javascript操作本地文件(读写txt文件)
  • 原文地址:https://www.cnblogs.com/Tunan-Ki/p/11795772.html
Copyright © 2020-2023  润新知