總結命令行02:Hive

一、概述:
       Hive提供了很多的函數,可以在命令行下show functions羅列所有的函數,你會發現這些函數名與mysql的很相近,絕大多數相同的,可通過describe function functionName 查看函數使用方法。hive支持的數據類型很簡單就INT(4 byte integer),BIGINT(8 byte integer),FLOAT(single precision),DOUBLE(double precision),BOOLEAN,STRING等原子類型,連日期時間類型也不支持,但通過to_date、unix_timestamp、date_diff、date_add、date_sub等函數就能完成mysql同樣的時間日期複雜操作。
如下示例:
1
select * from tablename where to_date(cz_time) > to_date('2050-12-31');
2
select * from tablename where unix_timestamp(cz_time) > unix_timestamp('2050-12-31 15:32:28');

分區
hive與mysql分區有些區別,mysql分區是用表結構中的字段來分區(range,list,hash等),而hive不同,他需要手工指定分區列,這個列是獨立於表結構,但屬於表中一列,在加載數據時手動指定分區。

創建表

1
hive> CREATE TABLE pokes (foo INT, bar STRING COMMENT 'This is bar'); 

創建表並創建索引字段ds

1
hive> CREATE TABLE invites (foo INT, bar STRING) PARTITIONED BY (ds STRING); 

顯示所有表

1
hive> SHOW TABLES;

按正條件(正則表達式)顯示錶,

1
hive> SHOW TABLES '.*s';

表添加一列 

1
hive> ALTER TABLE pokes ADD COLUMNS (new_col INT);

添加一列並增加列字段註釋

1
hive> ALTER TABLE invites ADD COLUMNS (new_col2 INT COMMENT 'a comment');

更改表名

1
hive> ALTER TABLE events RENAME TO 3koobecaf;

刪除數據表

1
hive> DROP TABLE pokes;

元數據存儲

將本地文件中的數據加載到表中

1
hive> LOAD DATA LOCAL INPATH './examples/files/kv1.txt' OVERWRITE INTO TABLE pokes; 

加載本地數據,同時給定分區信息

1
hive> LOAD DATA LOCAL INPATH './examples/files/kv2.txt' OVERWRITE INTO TABLE invites PARTITION (ds='2008-08-15');

加載DFS數據 ,同時給定分區信息

1
hive> LOAD DATA INPATH '/user/myname/kv2.txt' OVERWRITE INTO TABLE invites PARTITION (ds='2008-08-15');

1
The above command will load data from an HDFS file/directory to the table. Note that loading data from HDFS will result in moving the file/directory. As a result, the operation is almost instantaneous. 

SQL 操作

按先件查詢

1
hive> SELECT a.foo FROM invites a WHERE a.ds='';

將查詢數據輸出至目錄

1
hive> INSERT OVERWRITE DIRECTORY '/tmp/hdfs_out' SELECT a.* FROM invites a WHERE a.ds='';

將查詢結果輸出至本地目錄

1
hive> INSERT OVERWRITE LOCAL DIRECTORY '/tmp/local_out' SELECT a.* FROM pokes a;

選擇所有列到本地目錄 

1
hive> INSERT OVERWRITE TABLE events SELECT a.* FROM profiles a;

將一個表的統計結果插入另一個表中

1
hive> FROM invites a INSERT OVERWRITE TABLE events SELECT a.bar, count(1) WHERE a.foo > 0 GROUP BY a.bar;
2
hive> INSERT OVERWRITE TABLE events SELECT a.bar, count(1) FROM invites a WHERE a.foo > 0 GROUP BY a.bar;
發表評論
所有評論
還沒有人評論,想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.
相關文章