爬虫案例一

首先我举一个案例比如豆瓣电影排行榜 (douban.com)这个电影,首先我们进去检查源代码

说明源代码有,说明是服务器渲染,可以直接那html

但是返回的结果是空,所以我们需要在头里面加上User-Agent

然后可以看到有返回的结果,如果想拿到其中的名字这时候就要用re正则来进行匹配

然后这是自己写的正则,可能写的不够好

结果爬出来了

如果想拿到这3个信息,如何写呢

这是我写的re正则,看结果

如果我们像吧他们存放去了,可以导入csv包只是方便分析而已

结果

相关推荐
刘广睿20 分钟前
批量截图与长图拼接:自动化工作流的三种实现方案对比
爬虫·自动化·效率工具·python3.11
大草原的小灰灰35 分钟前
Python基础语法
开发语言·python
小葱炖豆腐2 小时前
python绘制excel折线图
python·excel·numpy·pandas·matplotlib
Ticnix2 小时前
MCP 实战:把工具层从 Agent 里彻底解耦
python·mcp
XZ-0700013 小时前
week4-1-figure画布
python
步行cgn4 小时前
Spring 注入 Map 集合详解
数据库·python·spring
今儿敲了吗4 小时前
03停用词过滤
笔记·python
李可以量化5 小时前
Tornado 部署公域网络安全与防护(上)
python
风跟我说过她5 小时前
SQL 一键转经典 Chen 风格 ER 图:开源 CLI + 在线工具 + Agent Skill
数据库·python·sql·开源·开源软件
Ulyanov5 小时前
AudioVision Pro:基于 PySide6 + sounddevice 的实时音频可视化播放器设计
python·算法·音视频