【LINUX】shell中模拟爬虫

url_home="http://localhost:8080"

curl ${url_home} -o 1.html

cat 1.html | grep 'href="' | awk -F"\"" '{ print $2 }' >urls.txt

cat 1.html | grep 'href="' | awk -F"\"" '{ print 3 }' \| awk -F"\<" '{ print 1 }' | sed "s:>::g"|sed "s: :_:g" > titles.txt

打开文件1

exec 3< urls.txt

打开文件2

exec 4< titles.txt

读取文件1和文件2的内容

while read -u 3 url && read -u 4 title

do

echo "url: $url"

echo "title: $title"

curl "{url_home}/url" -o "${title}.html"

done

关闭文件

exec 3<&-

exec 4<&-

相关推荐
woshihonghonga41 分钟前
停止Conda开机自动运行方法
linux·人工智能·conda
遇见火星4 小时前
Ubuntu Docker 容器化部署教程
linux·ubuntu·docker
ybb_ymm5 小时前
mysql8在linux下的默认规则修改
linux·运维·数据库·mysql
半梦半醒*5 小时前
zabbix安装
linux·运维·前端·网络·zabbix
Panda__Panda6 小时前
docker项目打包演示项目(数字排序服务)
运维·javascript·python·docker·容器·c#
xx.ii6 小时前
Docker监控
运维·docker·容器
板鸭〈小号〉6 小时前
Socket网络编程(2)-command_server
运维·服务器
维尔切7 小时前
Docker 存储与数据共享
运维·docker·容器
温柔一只鬼.7 小时前
Docker快速入门——第四章Docker镜像
运维·docker·容器
温柔一只鬼.8 小时前
Docker快速入门——Windowns系统下Docker安装(2025最新理解与完整,附带WSL1如何升级为WSL2)
运维·docker·容器