2023.11.16-hive sql高阶函数lateral view,与行转列,列转行

目录

[0.lateral view简介](#0.lateral view简介)

1.行转列

需求1:

需求2:

2.列转行

解题思路:


0.lateral view简介

hive函数 lateral view 主要功能是将原本汇总在一条(行)的数据拆分成多条(行)成虚拟表,再与原表进行笛卡尔积,从而得到明细表。配合UDTF函数使用,一般情况下经常与explode函数搭配,explode的操作对象(列值)是 ARRAY 或者 MAP ,可以通过 split 函数将 String 类型的列值转成 ARRAY 来处理。

炸裂函数配合侧视图使用如下

格式:select 原表别名.字段名,侧视图名.字段名 from 原表 原表别名 lateral view explode(要炸开的字段) 侧视图名 as 字段名 ;

1.行转列

-- 数据准备

--建表

sql 复制代码
create table row2col2(

                         col1 string,

                         col2 string,

                         col3 int

)row format delimited fields terminated by '\t';

--加载数据到表中

sql 复制代码
load data inpath '/input/r2c2.txt' into table row2col2;

-- 验证数据

sql 复制代码
select * from row2col2;

需求1:

需求1: 把原表数据变成以下格式

a b [1,2,3]

c d [4,5,6]

思路:使用collect_list()函数有序不去重

sql 复制代码
select
    col1,
    col2,
    collect_list(col3) -- 先将col3收集
from row2col2
group by
    col1, col2;

需求2:

需求2: 把原表数据变成以下格式

a b '1-2-3'

c d '4-5-6'

思路:1,2,3已经知道怎么收集了,可以用concat来将这几个数字与符号-拼接起来

concat_ws():函数在连接字符串的时候,只要有一个字符串不是NULL,就不会返回NULL。concat_ws():函数需要指定分隔符。

但concat_ws只支持拼接字符串,所以需要先用cast强转成字符串

  • cast(内容 as 类型)
  • concat_ws的格式: select concat_ws('要拼接的分隔符','字符串1','字符串2');
sql 复制代码
select col1,col2,
       concat_ws('-',(collect_list(cast(col3 as string))))
from row2col2
group by col1, col2
;

2.列转行

1.准备数据

sql 复制代码
--创建表
create table col2row2(
                         col1 string,
                         col2 string,
                         col3 string
)row format delimited fields terminated by '\t';

2.加载数据

sql 复制代码
--加载数据
load data  inpath '/source/c2r2.txt' into table col2row2;

3.验证数据

sql 复制代码
select * from col2row2;

解题思路:

sql 复制代码
-- 单列数据先切割再炸开
-- explode只能炸一个参数,只能接收数组或映射作为参数
select explode(col3)from col2row2; --报错
--无法直接炸col3字段,因为是字符串类型,并且题中的1,2,3并不是'一个'参数

select split(col3,',') from col2row2;
--用split切割后,会将切割完的数据放进数组里 [""1"",""2"",""3""][""4"",""5"",""6""]

select explode(split(col3,',')) from col2row2;
--得到了数组后,可以用explode来炸了

使用lateral view生成最终的表

格式:select 原表别名.字段名,侧视图名.字段名 from 原表 原表别名 lateral view explode(要炸开的字段) 侧视图名 as 字段名 ;

sql 复制代码
select col2row2.col1 , col2row2.col2 ,c2r.col3_explode
from col2row2
lateral view
explode(split(col3,',')) c2r as col3_explode  --用lv函数造出虚拟表c2r,col3_explode是字段名
;
相关推荐
Elastic 中国社区官方博客1 分钟前
从向量到关键词:在 LangChain 中的 Elasticsearch 混合搜索
大数据·开发语言·数据库·elasticsearch·搜索引擎·ai·langchain
山岚的运维笔记8 分钟前
SQL Server笔记 -- 第34章:cross apply
服务器·前端·数据库·笔记·sql·microsoft·sqlserver
量化炼金 (CodeAlchemy)9 分钟前
【交易策略】低通滤波器策略:在小时图上捕捉中期动量
大数据·人工智能·机器学习·区块链
培培说证14 分钟前
2026 大专大数据与会计专业考证书门槛低的有哪些?
大数据
2501_943695331 小时前
高职金融大数据应用专业,CDA证和金融从业资格证怎么选?
大数据·金融
沉睡的无敌雄狮1 小时前
政务AI口播落地:矩阵跃动一体机100%本地化部署与零数据出域——某省大数据局3个月验证
大数据·人工智能·深度优先·动态规划·政务
weilaikeqi11111 小时前
佳建科技:深耕ICT服务,聚力算力创新,赋能数智未来
大数据·人工智能·科技
1688red1 小时前
Elasticsearch集群安装部署及kibana配置
大数据·elasticsearch·jenkins
小五传输1 小时前
制造业图纸防护:文件安全外发管控产品推荐指南
大数据·运维·安全
edisao1 小时前
第三章 合规的自愿
jvm·数据仓库·python·神经网络·决策树·编辑器·动态规划