hive将时间字符串转换为timestamp的几种写法

写法一

sql 复制代码
select from_utc_timestamp(from_unixtime(unix_timestamp('2023-8-7 9:38:10 UTC+08:00', 'yyyy-MM-dd HH:mm:ss')), 'UTC');

写法二

sql 复制代码
select cast(unix_timestamp('2023-8-7 9:38:10 UTC+08:00', 'yyyy-MM-dd HH:mm:ss') as timestamp);

写法三

sql 复制代码
select cast(trim(split(upper('2023-10-31 4:46:40 UTC+0800'), 'UTC')[0]) as timestamp); 

这种方式我觉得过于复杂了。

使用到的函数

unix_timestamp

  • 函数签名
bash 复制代码
bigint unix_timestamp(string datetime, string format)
  • 函数返回值

    bigint类型的时间戳整数

  • 函数入参

    第一个参数是string类型的时间,比如'2024-01-10 20:44:00'。

    第二个参数是string类型的时间格式化的格式,比如'yyyy-MM-dd HH:mm:ss'。

  • 函数使用

bash 复制代码
-- 将给定时间字符串转换为指定格式的时间戳数字
select unix_timestamp('2023-12-4 4:45:12 UTC+08:00', 'yyyy-MM-dd HH:mm:ss');
-- 输出为1701619200
bash 复制代码
-- 获取当前时间戳
select unix_timestamp();
  • 注意点
    方法的返回值在spark中可以直接强转为timestamp。
    在hive中不能直接转为timestamp,强转会转为很奇怪的时间。
    如果要在hive中将此函数返回值转为timestamp,则需要使用cast函数转为timestamp。

from_unixtime

  • 函数签名
bash 复制代码
string from_unixtime(bigint time, string fromat)
  • 函数返回值

  • 函数参数

    bigint类型的时间戳。

    string类型的格式,用于指定函数返回值的格式,可以省略,如果省略,则默认为'yyyy-MM-dd HH:mm:ss'

  • 函数使用

bash 复制代码
select from_unixtime(1701619200, 'yyyy-MM-dd HH:mm:ss');
bash 复制代码
-- 省略format
select from_unixtime(1701619200);

测试

可以使用以下字符串作为输入进行测试。

以下各市的字符串经过在beeline客户端进行测试,均能转换为timestamp,且时间精度不会丢失

sql 复制代码
2023-8-31 15:40:56

-- 能够将带有UTC格式的字符串转换为时间戳,然后再转换为timestamp。
-- 但是会有8个小时的误差,上述的方法貌似是直接把UTC字符串给去掉了。                                                                                                                                                          
2023-12-4 4:45:12 UTC+0800

2023-10-17 3:38:1 UTC+0800

2023-5-3 13:7:0

2024-01-10 20:44:00.048

参考

unix_timestamp 时间戳函数用法(hive)

相关推荐
IT毕设梦工厂9 小时前
计算机毕业设计选题推荐:基于大数据的印度上市公司财务指标数据可视化分析|毕业设计选题|计算机毕设|选题推荐|毕设指导|项目定制|源码|高质量项目
大数据·hadoop·python·信息可视化·spark·课程设计·大数据毕设项目
爱吃火鸡面呀14 小时前
HDFS 文件读取流程深度解析:从客户端请求到数据落地的完整链路
大数据·hadoop·hdfs
程序员小羊!14 小时前
医疗数据仓库ODS层敏感信息防护实战:7大关键策略
数据仓库
kaoa00015 小时前
Linux入门攻坚——89、Hadoop-1-架构及概念
大数据·linux·hadoop·分布式
BYSJMG16 小时前
计算机毕业设计选题推荐:基于大数据的水质多指标关联分析与可视化的设计与实现,Spark 加 K-Means 做水质分群
大数据·hadoop·信息可视化·数据分析·spark·kmeans·课程设计
计算机源码社17 小时前
【大数据项目实战】基于Python数据挖掘的新能源车充电行为关联风险分析研究-基于Hadoop+Spark的电动汽车故障多维数据可视化
大数据·hadoop·python·数据挖掘·spark·毕业设计·课程设计
欢迎来到祖安!20 小时前
企业微信 API 接口能力介绍:支持消息收发、图片发送、表情互动、联系人管理等多场景应用
java·前端·数据仓库·spring cloud·企业微信
磁场转动100万匹2 天前
大数据入门:Hadoop 与 MapReduce 学习路线
大数据·hadoop·mapreduce
崖边看雾2 天前
Hadoop —— HDFS 写数据流程
大数据·hadoop·hdfs
陈年老古董2 天前
Python模拟MapReduce分治思想 | 从单文件统计到大文件拆分聚合 学习笔记
开发语言·hadoop·笔记·python·学习