COUNT(DISTINCT)在GROUP BY中统计每组唯一值个数,新版主流数据库支持,老版MySQL需用子查询去重后计数;多字段DISTINCT统计组合唯一性,非分别去重;性能差时宜用近似函数或预汇总。GROUP BY 后想统计每组里 DISTINCT 值个数,别直接套 COUNT(DISTINCT ...)MySQL 5.7+、PostgreSQL、SQL Server 2017+ 和 Oracle 都支持 COUNT(DISTINCT column) 在聚合查询中直接使用,但老版本 MySQL(如 5.6)不支持,会报错 ERROR 1111 (HY000): Invalid use of group function。不是语法写错了,是引擎限制。实操建议:先确认你的数据库版本:SELECT VERSION();,再决定能否用 COUNT(DISTINCT ...)如果不能用,得绕路:对分组字段和目标字段做联合去重,再外层计数,比如:SELECT group_col, COUNT(*) AS distinct_cntFROM (SELECT DISTINCT group_col, target_col FROM tbl) tGROUP BY group_col;注意子查询里必须包含所有 GROUP BY 字段,否则外层 GROUP BY 会出错或结果不准想列出每组的所有唯一值(不止个数),STRING_AGG 或 GROUP_CONCAT 更合适单纯统计数量只是第一步;很多时候你需要看到具体有哪些值------比如"每个部门有哪些职级""每类商品用了哪些标签"。这时 COUNT(DISTINCT ...) 就不够用了。实操建议:PostgreSQL 用 STRING_AGG(DISTINCT col, ', '),DISTINCT 关键字必须紧贴字段名,不能写成 STRING_AGG(col, ', ') DISTINCTMySQL 用 GROUP_CONCAT(DISTINCT col SEPARATOR ', '),注意默认长度限制是 1024,超长会被截断,需提前设 SET SESSION group_concat_max_len = 1000000;SQLite 没有原生 DISTINCT 支持,得用子查询先去重再拼接:GROUP_CONCAT(val) FROM (SELECT DISTINCT group_id, val FROM t)DISTINCT 在多字段组合统计时,行为容易被误解写 COUNT(DISTINCT a, b) 看似是"统计 a 和 b 的组合唯一数",但实际就是统计 (a,b) 这一对值的去重数量。不是分别对 a 和 b 去重再相加,也不是取并集。 跃问 跃问是由阶跃星辰开发的免费AI智能问答助手,随时帮你智能搜索、高效阅读、识图理解、和你畅聊感兴趣的话题。
相关推荐
傻啦嘿哟5 小时前
某招聘平台爬虫:爬取招聘岗位数据,分析各城市薪资水平2501_933670795 小时前
2026秋招量化分析岗技能栈:Python、SQL、统计建模、回测项目怎么准备2601_962077605 小时前
python Dejavu库快速识别音频指纹实例探究科技苑5 小时前
如何用Python编程实现一个简单的Web爬虫?程序员清风6 小时前
Java 后端高并发设计:线程池、限流、熔断与降级天衍四九-6 小时前
MySQL中如何定位慢查询?如果SQL语句执行很慢,如何分析和优化?dayDayupbetter6 小时前
Visual C++ 2010安装与使用高手秘籍隐擎fox6 小时前
深入理解网络传输层安全:TLS 指纹识别(JA3/JA4)原理与 Python 协议层检测实战尚久龙6 小时前
mysql-5.7.26-winx64的安装步骤医疗信息化王工6 小时前
DataForge:基于 Python 的数据库批量导出 Excel 工具——从架构到部署的全流程实战