为什么要避免 SELECT *

避免 SELECT * 是数据库开发中的一条重要原则,主要基于以下几个核心原因:


1. 性能浪费

  • 不必要的 I/O :读取不需要的列会增加磁盘 I/O,尤其当表包含大字段(如 TEXTBLOB、长字符串)时,代价巨大。
  • 内存与 CPU 开销:数据库需要将多余的数据加载到内存,并进行解析、传输,消耗更多 CPU 和内存资源。

2. 网络传输负担

  • 在客户端与数据库分离的场景(如应用程序服务器 + 数据库服务器),SELECT * 会传输大量无用数据,增加网络延迟,尤其在云环境或跨机房部署时影响显著。

3. 索引无法有效覆盖

  • 如果只需要少数几个字段,可以创建覆盖索引 ,直接通过索引返回数据(Using index),避免回表查询。
    使用 SELECT * 会强制回表,即使查询条件用到了索引,性能也会大打折扣。

4. 可读性与维护性差

  • 表结构变化引发隐患 :当表增加新列,SELECT * 会无差别返回所有列。如果应用代码未正确处理新增列(例如按位置取列值),可能导致程序异常或数据错乱。
  • 意图不清晰:阅读代码的人不知道实际需要哪些字段,增加维护难度。

5. 连接操作(JOIN)时的膨胀

  • 多表 JOIN 时使用 SELECT * 会返回所有参与表的全部列,极易产生重复列名(如 idname),并导致结果集行数不变但列数爆炸,浪费大量内存和网络资源。

✅ 正确做法

  • 只选择需要的列SELECT col1, col2 FROM table
  • 明确列名 :即使在 INSERT ... SELECT 或临时调试时也尽量列出字段
  • 利用工具/框架:ORM(如 MyBatis、Hibernate)中只映射必要字段

📌 唯一例外(可接受使用 SELECT *

  • 极低频率的临时查询 (手动 SELECT * 看一眼数据样本)
  • 已知表只有少数几列且未来不会变化(如配置表、字典表)
  • 使用 EXISTS 子查询时SELECT * 会被优化器忽略,写 SELECT 1 更规范)

💬 面试回答模板

"避免 SELECT * 主要是为了性能、网络和可维护性。它会额外读取不需要的列,增加磁盘 I/O 和网络传输;无法利用覆盖索引,容易导致回表;同时表结构变更时可能引发未知错误。最佳实践是始终显式列出所需字段。"

相关推荐
liangsheng_g3 分钟前
Spring事务传播行为分派与挂起恢复源码实战
数据库·sql·spring
杨云龙UP1 小时前
MySQL Host is blocked because of many connection errors 导致 JDBC 连接失败排查与解决
linux·运维·网络·数据库·sql·mysql·登录失败
旺仔不是程序员3 小时前
复合索引最左前缀原则:PostgreSQL 的 WHERE 为什么必须命中第一列
数据库·后端·sql
旺仔不是程序员3 小时前
字段类型不一致:PostgreSQL 报错与索引失效的第一元凶
数据库·后端·sql
geovindu4 小时前
sql: Data Modeling Patterns
数据库·sql·设计模式·sqlserver
瀚高PG实验室4 小时前
瀚高数据库如何克隆表
数据库·sql·postgresql·瀚高数据库
bksczm5 小时前
MySQL基础篇之表的增删查改(CRUD)细则
sql·mysql
不剪发的Tony老师5 小时前
DuckDB教程:常用文本函数
数据库·sql·数据分析·duckdb
风跟我说过她1 天前
SQL 一键转经典 Chen 风格 ER 图:开源 CLI + 在线工具 + Agent Skill
数据库·python·sql·开源·开源软件
兀兀术1 天前
windows下忘记pgsql密码
sql·pgsql