java replaceAll 正则逐个替换字符串的效率低问题验证

2024年6月21日

问题

今天突然有个代码步骤变快了,之前要几分钟执行完成,突然十几秒就能结束,这两天只调整了用replaceAll替换字符串的地方,写了一段程序一测,还真是! 旧逻辑:近万条数据,每条可能要替换几百个字符,很耗时,每条都当做O(N) 新逻辑:每条先检查长度,要替换的字符超过6个直接换成"******",快,每条当做O(1) 艹昨天我还写正则预查哪哪好用,今天就打脸

测试代码

写代码测了下两种耗时,一万条String,每条替换中间的100个字符

java 复制代码
public class Main {
    public static void main(String[] args) {
        int size = 10000;//一万
        // 104个字符
        String s = "xx1234567890123456789012345678901234567890123456789012345678901234567890123456789012345678901234567890xx";
        List<String> list = new ArrayList<>(size);
        for (int i = 0; i < size; i++) {
            list.add(s);
        }
        {
            long begin = System.currentTimeMillis();
            List<String> res = new ArrayList<>(size);
            list.forEach(item -> {
                String str = item.replaceAll("(?<=.{2}).(?=.{2})", "*");
                res.add(str);
            });
            long end = System.currentTimeMillis();
            System.out.println("正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:" + (end - begin));
        }
        {
            long begin = System.currentTimeMillis();
            List<String> res = new ArrayList<>(size);
            list.forEach(item -> {
                String str = item.substring(0,4) + "******";
                res.add(str);
            });
            long end = System.currentTimeMillis();
            System.out.println("普通替换字符,耗时毫秒:" + (end - begin));
        }
    }
}

结果,正则替换250ms,截取替换只要3ms

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:250
普通替换字符,耗时毫秒:3

时间差距不大,换成一百万条数据再试,一百万条数据每条替换100个字符,好,时间差了300倍:

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:8221
普通替换字符,耗时毫秒:27

又试了下一万条条数据每条替换100*100个字符,正则替换数量级相近,普通替换只要2ms

java 复制代码
正则替换:(?<=.{2}).(?=.{2}) 替换每个字符,耗时毫秒:7292
普通替换字符,耗时毫秒:2

结论,replaceAll用正则逐个替换字符效率不太乐观,一万×一万个字符耗时7-8秒;普通替换字符串方法受数据量影响,但不是很大,都比较快

相关推荐
又是忙碌的一天44 分钟前
Java IO流
java·开发语言
程序员buddha1 小时前
springboot-mvc项目示例代码
java·spring boot·mvc
不懂英语的程序猿1 小时前
【Java 工具类】Java通过 TCP/IP 调用斑马打印机(完整实现)
java
多多*3 小时前
分布式系统中的CAP理论和BASE理论
java·数据结构·算法·log4j·maven
sg_knight3 小时前
Docker 实战:如何限制容器的内存使用大小
java·spring boot·spring·spring cloud·docker·容器·eureka
合作小小程序员小小店3 小时前
web网页开发,在线考勤管理系统,基于Idea,html,css,vue,java,springboot,mysql
java·前端·vue.js·后端·intellij-idea·springboot
随便叫个啥呢5 小时前
java使用poi-tl模版+vform自定义表单生成word,使用LibreOffice导出为pdf
java·pdf·word
面向星辰6 小时前
扣子开始节点和结束节点
java·服务器·前端
烤麻辣烫6 小时前
黑马程序员苍穹外卖(新手)Day1
java·数据库·spring boot·学习·mybatis
失散137 小时前
分布式专题——51 ES 深度分页问题及其解决方案详解
java·分布式·elasticsearch·架构