oracle中基于正则表达式匹配规则提取子串的函数REGEXP_SUBSTR

REGEXP_SUBSTR 函数 ------ 复杂 / 动态结构字符串的解决方案

适用场景:

不知道子串的固定位置,但知道子串的内容格式(如数字、邮箱、特定分隔符分割的内容);

字符串结构不固定(如混合文字 + 数字、分隔符位置不固定等),SUBSTR 无法直接实现。

示例:

sql 复制代码
-- 示例1:提取字符串中第一个数字串(位置不固定,SUBSTR无法直接实现)
SELECT REGEXP_SUBSTR('订单号:ORD20240109,金额:999元', '\d+') AS result FROM DUAL;
-- 输出:20240109

-- 示例2:按分隔符提取第3个元素(分隔符位置不固定,SUBSTR需嵌套INSTR,步骤繁琐)
SELECT REGEXP_SUBSTR('苹果|香蕉|橙子|葡萄', '[^|]+', 1, 3) AS result FROM DUAL;
-- 输出:橙子

-- 示例3:提取邮箱中的域名(格式匹配,SUBSTR需先找@的位置,且适配性差)
SELECT REGEXP_SUBSTR('test_123@oracle.com', '@(.+)', 1, 1, 'c', 1) AS 域名 FROM DUAL;
-- 输出:oracle.com

-- 【对比】用SUBSTR实现示例3(步骤多,且若邮箱有异常格式则失效)
SELECT SUBSTR('test_123@oracle.com', INSTR('test_123@oracle.com', '@')+1) AS 域名 FROM DUAL;

对比 SUBSTR 函数而言,各自有不同的使用场景。

SUBSTR 函数:

明确知道要提取的子串在源字符串中的起始位置和长度;

字符串格式完全固定(如身份证号、固定长度的编码等)。

在实际开发中,遵循 "能用 SUBSTR 就不用 REGEXP_SUBSTR" 的原则:

若字符串结构固定(如固定长度编码、身份证号、手机号分段),优先用SUBSTR,性能更高、代码更简洁;

若字符串结构动态 / 不规则(如提取任意位置的数字、按分隔符提取第 N 个元素、匹配邮箱 / 手机号格式),再用REGEXP_SUBSTR。

总结

  1. SUBSTR是固定位置 / 长度的字符串截取工具,性能最优,适合结构固定的字符串;
  2. REGEXP_SUBSTR是复杂模式匹配工具,灵活性强,适合结构不固定、需按内容匹配的场景,但性能略低;
  3. 选型核心:先判断字符串结构是否固定,固定用SUBSTR,不固定用REGEXP_SUBSTR。
相关推荐
这个DBA有点耶3 天前
MVCC深入:Read View、版本链与快照读——InnoDB并发控制的内核
数据库·mysql·架构
DBA_G3 天前
从地面到云霄:GBase数据库在民航三大场景的落地实践
数据库
自由能燃气设备3 天前
商用全预混低氮冷凝锅炉免费方案vs付费方案对比+选型避坑指南
大数据·数据库·人工智能
科创致远3 天前
科创致远 ESOP 系统核心效能与实战价值展示
大数据·数据库·人工智能·精益工程
2601_962218613 天前
万象生鲜系统称重自动多退少补算法解决生鲜非标品痛点
大数据·数据库·人工智能·python·算法
张洛闻Eren3 天前
k8s云原生【第十课】:水平 Pod 自动扩缩容
运维·数据库·云原生·kubernetes·github
于平安3 天前
MySQL-触发器
数据库·mysql
白远山3 天前
上海24小时自助健身房解决方案实战指南与经验分享
java·数据库·架构·需求分析
Omics Pro3 天前
斯坦福Nature+Science|广义虚拟细胞基础大模型
数据库·人工智能·算法·机器学习·自然语言处理
2603_965148113 天前
AI+API选品:下一代智能商务助手雏形已现
java·大数据·数据库·人工智能·数据挖掘