trino tpcds测试

先下载tpcds-kit(有Linux和macOS),根据其文档生成数据和查询的sql。

然后hive-testbench,在ddl-tpcds/text/alltables.sql中有建表语句(用hive建表)。

建完表后LOAD DATA local INPATH "/Users/ding/tools/tpcds-kit/data/web_site.dat" OVERWRITE INTO TABLE tpcds.web_site;导入数据到对应表里。

写test.sh和trino-tpcds.sh两个脚本跑99条sql(q72可能失败,可将其删除)

test.sh如下

复制代码
#!/bin/bash
for sql in `find tpcds-queries -type f`
do 
	sh trino-tpcds.sh ${sql}
done

trino-tpcds.sh如下

复制代码
#!/bin/bash
echo $1:
java -jar trino-cli-406-executable.jar --server IP_ADDRESS:8080  --catalog hive --schema tpcds  -f $1 --progress
echo "$1 end"

执行命令nohuo sh test.sh &

nohup会将命令的输出结果重定向到nohup.out中,然后vim nohup.out,通过搜索tpcds-queries关键字查看每条sql的运行时间

相关推荐
不动明王19845 天前
Presto 查询引擎内核详解:整体架构与查询执行流程
架构·presto·分布式调度·pipeline执行·计算引擎内核
不动明王19847 天前
Presto 查询引擎内核详解:基于多级反馈队列思想的 Worker 调度模型
presto·调度执行·多级反馈队列·交互式查询引擎
梦想画家11 天前
告别冷数据焦虑:用 Trino + HMS 打造低成本 S3 数据湖查询引擎
trino·数据湖仓·联邦查询
不动明王198413 天前
Presto 查询引擎内核详解:Worker 本地执行模型——从物理计划到可调度执行单元
大数据·presto·湖仓·查询引擎内核·pipeline执行
james的分享14 天前
分布式 SQL 查询引擎之Trino
ai·mpp·trino·lakehouse
不动明王198417 天前
Presto 查询引擎内核详解:集群资源管理机制解析
内存管理·计算引擎·presto·revoking·memorypool
不动明王198417 天前
能力联邦:Presto 的一种可能演进方向
大数据·iceberg·presto·湖仓·lance·联邦查询引擎
梦想画家21 天前
用SQL驱动AI:Trino AI Functions跨源情报分析实战指南
sql·ai·trino
zhojiew3 个月前
在AWS中国区启动Trino使用Iceberg REST Endpoint查询S3 Tables的实践
大数据·trino·s3table
く成哦3 个月前
部署Apache Gravitino项目及使用教程
jupyter·docker-compose·apache·trino·playground·gravitino