统计数据时,sql执行超时,如何处理

在工作中,除了开发,有时还需要做一些数据统计。

统计数据时,sql执行超时。

可以通过以下手段处理。

一、优化sql

首先,通过 EXPLAIN 查看执行计划,看有没有走索引,能加索引的加索引,没有走索引的尽量优化。

常见的sql优化见: https://blog.csdn.net/sinat_32502451/article/details/136075255

二、临时调大超时时间

如果默认的超时时间是1分钟,可以先临时调大,待sql 执行完毕,再调整回去。

复制代码
SET SESSION max_execution_time = 120000; -- 单位是毫秒 (ms),这里设为 120 秒

或者是:

复制代码
--  通过 /*+ MAX_EXECUTION_TIME(120000) */  调整这次查询的超时时间。
SELECT /*+ MAX_EXECUTION_TIME(60000) */ user_id FROM t_users ;

三、建临时表

如果一个 sql 很复杂,那么就要尽量拆分,可以通过临时表来协助。

比如:

复制代码
SELECT 
    u.user_id,
    t.event_name
FROM t_users u
LEFT JOIN (
    SELECT DISTINCT user_id, event_name
    FROM t_activities
    WHERE date BETWEEN '2020-07-31' AND '2020-08-31'
) t ON u.user_id = t.user_id;

这个sql, 可以先将 LEFT JOIN 里面(也可以是子查询) 的数据先放进临时表。

注意:如果某些sql不允许使用 CREATE TEMPORARY TABLE 这种语法,也可以用 CREATE TABLE。

复制代码
-- 第一步:创建并填充临时表(只存去重后的 ID)
CREATE TEMPORARY TABLE tmp_active_users AS
SELECT DISTINCT user_id 
FROM t_activities 
WHERE date BETWEEN '2020-07-31' AND '2020-08-31';

-- 第二步:直接关联查询
SELECT u.user_id
FROM t_users u
JOIN tmp_active_users t ON u.user_id = t.user_id;

这种用临时表处理后,数据量会极大地下降,sql 执行时间会降低。

四、CSV 导出导入

如果连建临时表都超时了,那也可以先 SELECT , 然后用 CSV 导出再导入。

导出导入格式,最好用 CSV, 非常轻量。

详情见:
https://blog.csdn.net/sinat_32502451/article/details/159658198

五、写代码统计

某些太复杂的 sql,可以先分批查出表数据,导出到 excel,最后再通过写代码,读取excel数据,进行统计。

相关推荐
属于自己的天空2 分钟前
不用再手动查表结构了:配好 MCP,Claude Code 自己读数据库生成代码
数据库·后端
Y3815326626 分钟前
SERP 数据清洗实战:字段标准化、日期解析与去重键
开发语言·数据库·python·python数据库
Databend27 分钟前
Databend 原生数据血缘:追溯指标来源,检查变更影响
大数据·数据库·sql
镜舟科技37 分钟前
Semantic View 技术解析(二):业务口径如何进入数据库执行路径
数据库·sql·agent
TechWJ1 小时前
没有公网 IP 也想远程连 PostgreSQL?从本地数据库到固定 TCP 地址完整配置
大数据·数据库·网络安全·postgresql·内网穿透
华允物联-HUAIOT1 小时前
串口路由器是什么?带串口的工业联网设备科普
服务器
菜鸟学编程o2 小时前
Linux常见指令
linux·运维·服务器
得物技术2 小时前
指标平台:从语义底座到智能消费的实践路径|得物技术
数据库·人工智能·ai编程
StarRocks_labs2 小时前
当大模型调用进入执行引擎:StarRocks AI Function 全新能力解析
数据库·starrocks·sql·ai·pipeline·数据处理·join
TDengine (老段)2 小时前
TDengine 常见问题 TOP4
数据库·物联网·时序数据库·tdengine·涛思数据·升级·tdengine 问题