Hive数据类型

原生数据类型

准备数据

查看表信息

加载数据

查看数据

复杂数据类型-数组

准备数据

查看数据

​优化

复杂数据类型-map

准备数据

查看数据

复杂数据类型-默认分隔符

准备数据

查看数据


原生数据类型

准备数据

bash 复制代码
-- 1 建库
drop database if exists db_1 cascade;
create database if not exists db_1;
use db_1;

-- 2 建表
create table tb_archer(
    id int comment "ID",
    name string comment "英雄名称",
    hp_max int comment "最大生命",
    mp_max int comment "最大法力",
    attack_max int comment "最高物攻",
    defense_max int comment "最大物防",
    attack_range string comment "攻击范围",
    role_main string comment "主要定位",
    role_assist string comment "次要定位"
)
comment '射手表'
row format delimited fields terminated by '\t'
;

查看表信息

bash 复制代码
-- 查看表的信息
desc db_1.tb_archer;

-- 查看表的详细信息
desc formatted db_1.tb_archer;

加载数据

方式一:从本地加载到hdfs上

方式二:使用load命令将本地文件传到hdfs上

bash 复制代码
load data local inpath '/root/honor_of_kings/01_archer.txt' into table db_1.tb_archer_2;

方式三:使用load命令在hdfs上移动文件

bash 复制代码
-- 方式三:使用load命令将hdfs上的一个文件传到另一个目录下(这个是剪切效果,之前的文件将会没有)
load data inpath '/data/honor_of_kings/01_archer.txt' into table db_1.tb_archer_3;

hdfs没传之前

传之后

查看数据

bash 复制代码
select * from db_1.tb_archer;

复杂数据类型-数组

使用delimited关建字

复制代码
row format delimited fields terminated by ',' :每个列之间分割
collection items terminated by '-':集合之间的元素分割
map keys terminated by ':' :键值对之间分割
lines terminated by '\n':每行数据分割

准备数据

bash 复制代码
-- 创建表
create table db_1.tb_user(
    id int,
    name string,
    hobbys string
)
row format delimited fields terminated by ','
;

-- 加载数据
load data local inpath '/root/users.txt' into table db_1.tb_user;

-- 查看数据-
select * from db_1.tb_user;

查看数据

通过制定分隔符转化成数组

bash 复制代码
-- 节选最后一列的爱好
select
    id,
    name,
    hobbys,
    split(hobbys, '-'),
    split(hobbys, '-')[0],
    split(hobbys, '-')[1],
    split(hobbys, '-')[2]
from db_1.tb_user;
优化

加上delimited关建字,使用row format delimited来处理单分隔符问题

bash 复制代码
-- 创建表
create table db_1.tb_user_2 (
    id int,
    name string,
    hobbys array<string>
)
row format delimited fields terminated by ',' --每列之间用','分割
collection items terminated by '-'  -- 集合之间的元素用','分割
;

-- 加载数据
load data local inpath '/root/users.txt' into table db_1.tb_user_2;

-- 查看数据
select
    id,
    name,
    hobbys,
    hobbys[0],
    hobbys[1],
    hobbys[2]
from db_1.tb_user_2;

复杂数据类型-map

准备数据

bash 复制代码
-- 创建表
create table t_hot_hero_skin_price(
    id int,
    name string,
    win_rate int,
    skin_price map<string,int>
)
row format delimited fields terminated by ','
collection items terminated by '-'
map keys terminated by ':'  -- 键值对之间用':'分割
;

-- 加载数据
load data local inpath '/root/honor_of_kings/02_hot_hero_skin_price.txt' into table t_hot_hero_skin_price;

查看数据

bash 复制代码
-- 查看全部数据
select * from t_hot_hero_skin_price;

指定数据:查看id=1的"大圣娶亲"和"至尊宝"的皮肤价格。

bash 复制代码
select
    *,
    skin_price['大圣娶亲'],
    skin_price['至尊宝']
from t_hot_hero_skin_price
where id=1
;

复杂数据类型-默认分隔符

准备数据

bash 复制代码
-- 创建表
create table tb_team_ace_player(
    id int,
    team_name string,
    ace_player_name string
);

-- 加载数据
load data local inpath '/root/honor_of_kings/03_team_ace_player.txt' into table db_1.tb_team_ace_player;

查看数据

bash 复制代码
select * from db_1.tb_team_ace_player;

默认分隔符是^A

相关推荐
真上帝的左手2 小时前
19. 大数据- BI 入门-数仓实战4-DIM 维度层
大数据·数据仓库·bi
真上帝的左手2 小时前
19. 大数据- BI 入门-数仓实战终篇-数据仓库演进对比与深度思考
大数据·数据仓库·bi
陆水A3 小时前
【实时数仓·2】CDC到Doris数据对不上——Sequence Column解了吗?
大数据·数据仓库·数据库开发·etl工程师·bigdata
迈巴赫车主3 小时前
Hive中分组聚合导致的数据倾斜优化
数据仓库·hive·hadoop
真上帝的左手3 小时前
19. 大数据- BI 入门-数仓实战5-ADS 整体设计框架
大数据·数据仓库·bi
段一凡-华北理工大学3 小时前
工业领域的Hadoop架构学习~系列文章13:数据湖架构 - 工业大数据的统一存储底座
大数据·人工智能·hadoop·分布式·架构·高炉炼铁·高炉智能化
真上帝的左手3 小时前
19. 大数据- BI 入门-数仓实战2-ODS 原始数据层
大数据·数据仓库·bi
段一凡-华北理工大学3 小时前
工业领域的Hadoop架构学习~系列文章14:Hadoop集群部署 - 从规划到上线的全流程实践
大数据·数据库·人工智能·hadoop·学习·架构·高炉炼铁
暴躁小师兄数据学院14 小时前
【AI大数据工程师特训笔记】第16讲:大数据环境安装
大数据·hadoop·笔记·flink·spark·database
真上帝的左手17 小时前
19. 大数据-数仓建设解决方案
大数据·数据仓库