【Shell】模拟爬虫下载天龙八部小说

Shell脚本:

bash 复制代码
#curl https://tianlong.5000yan.com/ -o tianlong.html
grep "href=" tianlong.html | grep html | awk -F"\"" '{ print $6 }' >> urls.txt
grep "href=" tianlong.html | grep html | awk -F">" '{ print $3 }' | awk -F"<" '{ print $1 }' >>titles.txt

exec 3<urls.txt
exec 4<titles.txt

while read -u 3 url && read -u 4 title
do
	echo "$title : $url"
	curl "$url" -o "${title}.html"
done

exec 3<&-
exec 4<&-

下载后的文件:

下载后的效果:

相关推荐
嵌入式分享几秒前
驱动之路#44:硬件 I2C 和软件 I2C 谁更坑?
linux·嵌入式硬件
不会就选b9 分钟前
Linux之再次理解udp
linux·运维·udp
guo_wen_qiang29 分钟前
云服务器kibana环境搭建
linux·运维·服务器
锅里游的鱼吖36 分钟前
echarts自定义折线图
前端·javascript·数据库
酷虎软件37 分钟前
视频加标题字幕 API 接口文档
java·数据库·mysql
夜雪一千1 小时前
MySQL 触发器有哪些应用场景?从入门场景到避坑实战
数据库·mysql
流浪0011 小时前
Linux系统篇42——线程(七) pthread库管理线程的工作流,从创建到回收
linux·操作系统·线程·线程创建到销毁
Dragon~Snow1 小时前
Linux server CentOS stream 10系统构建
linux·运维·centos
lusklusklusk1 小时前
Oracle数据库基础之6_外部表临时表分区表_物化视图_约束的介绍
数据库·oracle
霞姐聊IT1 小时前
服务器RAS软件开发经验分享——从Linux、BMC与BIOS三个层面谈工程实践(二)
linux·服务器