【Shell】模拟爬虫下载天龙八部小说

Shell脚本:

bash 复制代码
#curl https://tianlong.5000yan.com/ -o tianlong.html
grep "href=" tianlong.html | grep html | awk -F"\"" '{ print $6 }' >> urls.txt
grep "href=" tianlong.html | grep html | awk -F">" '{ print $3 }' | awk -F"<" '{ print $1 }' >>titles.txt

exec 3<urls.txt
exec 4<titles.txt

while read -u 3 url && read -u 4 title
do
	echo "$title : $url"
	curl "$url" -o "${title}.html"
done

exec 3<&-
exec 4<&-

下载后的文件:

下载后的效果:

相关推荐
2501_931803752 分钟前
MySQL 增删改查详解
数据库
Sagittarius_A*8 分钟前
【LitCTF2026】lit_ezsql
android·java·数据库
亿朝亿夕8 分钟前
linux基础命令
linux
modelmd13 分钟前
Linux SIGTERM 信号
linux
keyipatience27 分钟前
IP网络层
服务器·网络·网络协议·ubuntu·http
未秃头的程序猿34 分钟前
分库分表一年后,我复盘了当时最该想清楚的三件事
java·数据库·后端
Discipline~Hai36 分钟前
Linux网络编程03-HTTP协议
linux·运维·服务器·网络·网络协议·http·linux网络编程
CV-杨帆39 分钟前
在自己的服务器上搭建VLLM 以Qwen3.5-0.8B与Qwen3.5-4B为模型基础
运维·服务器·vllm
心易行者1 小时前
用html在线运行做数据可视化大屏,5个实战场景从入门到上线
大数据·前端·数据库·人工智能·python