java replaceAll 正则逐个替换字符串的效率低问题验证

2024年6月21日

问题

今天突然有个代码步骤变快了,之前要几分钟执行完成,突然十几秒就能结束,这两天只调整了用replaceAll替换字符串的地方,写了一段程序一测,还真是! 旧逻辑:近万条数据,每条可能要替换几百个字符,很耗时,每条都当做O(N) 新逻辑:每条先检查长度,要替换的字符超过6个直接换成"******",快,每条当做O(1) 艹昨天我还写正则预查哪哪好用,今天就打脸

测试代码

写代码测了下两种耗时,一万条String,每条替换中间的100个字符

java 复制代码
public class Main {
    public static void main(String[] args) {
        int size = 10000;//一万
        // 104个字符
        String s = "xx1234567890123456789012345678901234567890123456789012345678901234567890123456789012345678901234567890xx";
        List<String> list = new ArrayList<>(size);
        for (int i = 0; i < size; i++) {
            list.add(s);
        }
        {
            long begin = System.currentTimeMillis();
            List<String> res = new ArrayList<>(size);
            list.forEach(item -> {
                String str = item.replaceAll("(?<=.{2}).(?=.{2})", "*");
                res.add(str);
            });
            long end = System.currentTimeMillis();
            System.out.println("正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:" + (end - begin));
        }
        {
            long begin = System.currentTimeMillis();
            List<String> res = new ArrayList<>(size);
            list.forEach(item -> {
                String str = item.substring(0,4) + "******";
                res.add(str);
            });
            long end = System.currentTimeMillis();
            System.out.println("普通替换字符,耗时毫秒:" + (end - begin));
        }
    }
}

结果,正则替换250ms,截取替换只要3ms

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:250
普通替换字符,耗时毫秒:3

时间差距不大,换成一百万条数据再试,一百万条数据每条替换100个字符,好,时间差了300倍:

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:8221
普通替换字符,耗时毫秒:27

又试了下一万条条数据每条替换100*100个字符,正则替换数量级相近,普通替换只要2ms

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:7292
普通替换字符,耗时毫秒:2

结论,replaceAll用正则逐个替换字符效率不太乐观,一万×一万个字符耗时7-8秒;普通替换字符串方法受数据量影响,但不是很大,都比较快

相关推荐
百锦再14 小时前
线程安全的单例模式全方位解读:从原理到最佳实践
java·javascript·安全·spring·单例模式·kafka·tomcat
百锦再15 小时前
Java synchronized关键字详解:从入门到原理(两课时)
java·开发语言·struts·spring·kafka·tomcat·maven
油丶酸萝卜别吃15 小时前
什么是 Java 内存模型(JMM)?
java·开发语言
量子炒饭大师15 小时前
【C++入门】Cyber神经的义体插件 —— 【类与对象】内部类
java·开发语言·c++·内部类·嵌套类
Hx_Ma1615 小时前
测试题(四)
java·开发语言·jvm
Never_Satisfied15 小时前
在c#中,抛出异常,并指定其message的值
java·javascript·c#
没有bug.的程序员15 小时前
IDEA 效能巅峰实战:自定义模板 Live Templates 内核、快捷键精密逻辑与研发提效深度指南
java·ide·intellij-idea·快捷键·研发提效·自定义模板
追随者永远是胜利者15 小时前
(LeetCode-Hot100)22. 括号生成
java·算法·leetcode·职场和发展·go
逝水如流年轻往返染尘15 小时前
java中的泛型
java
百锦再16 小时前
Java重入锁(ReentrantLock)全面解析:从入门到源码深度剖析
java·开发语言·struts·spring·kafka·tomcat·intellij-idea