Hive3:三种常用的复杂数据类型

一、Array类型

1、数据示例

2、实操

元数据

复制代码
zhangsan	beijing,shanghai,tianjin,hangzhou
wangwu	changchun,chengdu,wuhan,beijin

创建表

sql 复制代码
CREATE TABLE myhive.test_array(name string, work_locations array<string>)
ROW FORMAT DELIMITED FIELDS TERMINATED BY '\t'
COLLECTION ITEMS TERMINATED BY ',';

COLLECTION ITEMS TERMINATED BY ',' 表示集合(array)元素的分隔符是逗号

加载数据

sql 复制代码
load data local inpath '/home/atguigu/data_for_array_type.txt' overwrite into table myhive.test_array;

常用查询语句

sql 复制代码
-- 查询loction数组中第一个元素
select name, work_locations[0] location from myhive.test_array;
-- 查询location数组中元素的个数
select name, size(work_locations) location from myhive.test_array;
-- 查询location数组中包含tianjin的信息
select * from myhive.test_array where array_contains(work_locations,'tianjin');

二、Map类型

1、数据示例

2、实操

元数据

复制代码
1,林杰均,father:林大明#mother:小甜甜#brother:小甜,28
2,周杰伦,father:马小云#mother:黄大奕#brother:小天,22
3,王葱,father:王林#mother:如花#sister:潇潇,29
4,马大云,father:周街轮#mother:美美,26

创建表

sql 复制代码
CREATE TABLE myhive.test_map(id int, name string, members map<string,string>, age int)
ROW FORMAT DELIMITED FIELDS TERMINATED BY ','
COLLECTION ITEMS TERMINATED BY '#' 
MAP KEYS TERMINATED BY ':';

不同键值对之间:COLLECTION ITEMS TERMINATED BY '分隔符' 分隔

一个键值对内,使用: MAP KEYS TERMINATED BY '分隔符' 分隔K-V

加载数据

sql 复制代码
load data local inpath '/home/atguigu/data_for_map_type.txt' overwrite into table myhive.test_map;

常用查询语句

sql 复制代码
-- 查询father、mother这两个map的key
select id, name, members['father'] father, members['mother'] mother, age from myhive.test_map;
-- 查询全部map的key,使用map_keys函数,结果是array类型
select id, name, map_keys(members) as relation from myhive.test_map;
-- 查询全部map的value,使用map_values函数,结果是array类型
select id, name, map_values(members) as relation from myhive.test_map;
-- 查询map类型的KV对数量
select id,name,size(members) num from myhive.test_map;
-- 查询map的key中有brother的数据
select * from myhive.test_map where array_contains(map_keys(members), 'brother');

三、Struct类型

1、数据示例

2、实操

元数据

复制代码
1#周杰轮:11
2#林均杰:16
3#刘德滑:21
4#张学油:26
5#蔡依临:23

创建表

sql 复制代码
CREATE TABLE myhive.test_struct(id string, info struct<name:string, age:int>)
ROW FORMAT DELIMITED FIELDS TERMINATED BY '#'
COLLECTION ITEMS TERMINATED BY ':';

加载数据

sql 复制代码
load data local inpath '/home/atguigu/data_for_struct_type.txt' overwrite into table myhive.test_struct;


常用查询语句

sql 复制代码
# 直接使用列名.子列名 即可从struct中取出子列查询
select id, info.name from test_struct;

对比

相关推荐
元亓亓亓28 分钟前
考研408--操作系统--day4--进程同步&互斥&信息量机制
java·数据库·考研·操作系统·408
武子康31 分钟前
Java-169 Neo4j CQL 实战速查:字符串/聚合/关系与多跳查询
java·开发语言·数据库·python·sql·nosql·neo4j
现在,此刻1 小时前
高可用与高性能数据库配置实践分析(pgSql && clickhouse)
数据库·clickhouse
谅望者1 小时前
数据分析笔记02:数值方法
大数据·数据库·笔记·数据挖掘·数据分析
dreams_dream1 小时前
django模型数据查询
数据库·django·sqlite
郏国上2 小时前
由于图片视频替换和删除导致阿里云上存在大量系统不再使用的文件如何处理
数据库·mongodb·阿里云
q***65692 小时前
深入解析HDFS:定义、架构、原理、应用场景及常用命令
hadoop·hdfs·架构
百***27112 小时前
UNION 和 UNION ALL 的区别:深入解析 SQL 中的合并操作
数据库·sql·oracle
xie_pin_an3 小时前
Redis 核心命令速查表
数据库·redis·缓存
喵行星3 小时前
MySQL XtraBackup 使用文档(全量 + 增量备份与恢复)
数据库·mysql·adb