shell编程:sed - 流编辑器(6)

1.文本处理

(1)删除 HTML 标签

删除 HTML 标签:sed 's/<[^>]*>//g' sample.html
详细解释
• <[^>]*>:匹配 HTML 标签
• <:字面匹配
• [^>]*:非>字符的任意长度
• >:字面匹配
• g:全局替换为空
• 提取 HTML 中的纯文本
/<[^>]*>//是将 html 标签替换为空

(2)合并多行到一行

合并多行:sed ':a;N;!ba;s/\\n/ /g' file.txt \| head -1 **详细解释**: • :a:定义标签 a • N:读取下一行到模式空间 • !ba:如果不是最后一行,跳转到 a
• s/\n/ /g:将所有换行符替换为空格
• 将整个文件合并为一行

(3)给文件添加行号

添加行号:sed '=' file.txt | sed 'N; s/\n/ /'
详细解释
• =:打印当前行号
• sed '='输出行号和内容分行
• | sed 'N; s/\n/ /':读取两行,用空格替换换行
• 实现类似 nl 命令的功能
这个命令的执行结果是行号 内行内容的格式,行号后不跟冒号,比 grep 加行号更可视化

(4)将每行的第一个单词转为大写

首单词转大写:sed 's/^\([a-z]\)\([a-zA-Z]*\)/\U\1\E\2/' file.txt
详细解释
• ^\([a-z]\):捕获第一个小写字母
• \([a-zA-Z]*\):捕获剩余字母
• \U\1:将第一个捕获组转为大写
• \E:结束大写转换
• \2:引用第二个捕获组
• 使用 sed 的大小写转换功能

2.配置文件处理

(1)注释掉配置项

注释掉配置项:sed 's/^\(app\.debug=\)/#\1/' config.txt
详细解释
• ^\(app\.debug=\):捕获以"app.debug="开头的行
• \.:转义点号
• #\1:替换为#加上捕获的内容
• 实现注释功能

(2)取消注释

取消注释:sed 's/^#\+\(.*app\.maintenance.*\)/\1/' config.txt
详细解释
• ^#\+:行首一个或多个#
• \(.*app\.maintenance.*\):捕获包含 app.maintenance 的内容
• \1:只保留捕获组内容
• 移除注释符号

(3)修改配置值

修改配置值:sed '/^app\.debug=/s/=.*/=false/' config.txt
详细解释
• /^app\.debug=/:选择以 app.debug=开头的行
• s/=.*/=false/:将=后所有内容替换为=false
• 先选择行,再执行替换
• 精确修改配置值

相关推荐
wj3055853782 小时前
课程 9:模型测试记录与 Prompt 策略
linux·人工智能·python·comfyui
abigriver3 小时前
打造 Linux 离线大模型级语音输入法:Whisper.cpp + 3090 显卡加速与 Rime 中英混输终极调优指南
linux·运维·whisper
wangqiaowq3 小时前
windows下nginx的安装
linux·服务器·前端
YYRAN_ZZU4 小时前
Petalinux新建自动脚本启动
linux
charlie1145141914 小时前
嵌入式Linux驱动开发pinctrl篇(1)——从寄存器到子系统:驱动演进之路
linux·运维·驱动开发
于小猿Sup4 小时前
VMware在Ubuntu22.04驱动Livox Mid360s
linux·c++·嵌入式硬件·自动驾驶
cen__y4 小时前
Linux12(Git01)
linux·运维·服务器·c语言·开发语言·git
不仙5206 小时前
VMware Workstation 26.0.0 在 Ubuntu 24.04 (内核 6.17.0) 上的安装与内核模块编译问题
linux·ubuntu·elasticsearch
AI视觉网奇7 小时前
linux 检索库 判断库是否支持
java·linux·服务器
dapeng-大鹏7 小时前
KVM+LVM 零停机在线扩容 Ubuntu 根分区:从磁盘添加到逻辑卷扩展完整
linux·运维·ubuntu·磁盘空间扩展