您的位置:首页 > 数据库 > SQL

hive内部表、外部表

2016-06-24 10:04 603 查看
hive内部表、外部表区别自不用说,可实际用的时候还是要小心。

1. 内部表:

[sql] view
plain copy

 print?





create table tt (name string , age string) location '/input/table_data';  

此时,会在hdfs上新建一个tt表的数据存放地,例如,笔者是在 hdfs://master/input/table_data 

上传hdfs数据到表中:

[sql] view
plain copy

 print?





load data inpath '/input/data' into table tt;  

此时会将hdfs上的/input/data目录下的数据转移到/input/table_data目录下。

删除tt表后,会将tt表的数据和元数据信息全部删除,即最后/input/table_data下无数据,当然/input/data下再上一步已经没有了数据!

如果创建内部表时没有指定location,就会在/user/hive/warehouse/下新建一个表目录,其余情况同上。

注意的地方就是:load data会转移数据!

2. 外部表:

[sql] view
plain copy

 print?





create external table et (name string , age string);  

此时,会在/user/hive/warehouse/新建一个表目录et

[sql] view
plain copy

 print?





load data inpath '/input/edata' into table et;  

此时会把hdfs上/input/edata/下的数据转到/user/hive/warehouse/et下,删除这个外部表后,/user/hive/warehouse/et下的数据不会删除,但是/input/edata/下的数据在上一步load后已经没有了!数据的位置发生了变化!本质是load一个hdfs上的数据时会转移数据!

3. 其他:

(1)加上location用法一样,只不过表目录的位置不同而已。

(2)加上partition用法也一样,只不过表目录下会有分区目录而已。

(3)load data local inpath直接把本地文件系统的数据上传到hdfs上,有location上传到location指定的位置上,没有的话上传到hive默认配置的数据仓库中。

转自:http://blog.csdn.net/yeruby/article/details/23033273
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息