【Python网络爬虫笔记】5-(Request 带参数的get请求) 爬取豆瓣电影排行信息

目录

1.抓包工具查看网站信息

请求路径

c 复制代码
url:https://movie.douban.com/typerank


请求参数

页面往下拉,出现新的请求结果,参数start更新,每次刷新出20条新的电影数据

2.代码实现

python 复制代码
# 使用网络爬虫,爬取https://movie.douban.com/typerank 的电影数据

# 导入requests包
import requests

#请求路径
url = "https://movie.douban.com/j/chart/top_list"

# 请求头
headers = {
    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/131.0.0.0 Safari/537.36 Edg/131.0.0.0"
}

# 参数
params = {
    "type": "11",
    "interval_id": "100:90",
    "action": "",
    "start": 60,
    "limit": 20
}

# 发送请求,获取响应
response = requests.get(url, params=params,headers=headers)

# 输出
print(response.json())

# 关闭响应
response.close()

3.运行结果

start为60 的运行结果


start为0 的运行结果

相关推荐
ctlover6 分钟前
Python模块与包
开发语言·python
月光船幽幽8 分钟前
锁死后干预有效性的关键突破
人工智能·python·算法
阳光开朗男孩18 分钟前
Pytorch的安装与配置
人工智能·pytorch·python
等一朵映山红21 分钟前
动态图 vs 静态图:PyTorch 与 TensorFlow 架构底层对比
人工智能·pytorch·python
过期的秋刀鱼!25 分钟前
决策树-测量纯度
人工智能·python·深度学习·算法·决策树·机器学习·数据挖掘
IT古董41 分钟前
【MES学习笔记系列】MES 术语表
笔记·学习
卷无止境1 小时前
Python 依赖管理这件事,到底该看哪个文件
后端·python
卷无止境1 小时前
FastAPI 缓存方案全解析:从内存到分布式的工程实践
后端·python
烟漠河洛1 小时前
一条走廊,两张地图
python
苏灿烤鱼1 小时前
GitHub #2 拆解|仅 +59,代码知识图谱为什么仍值得关注?
python·agent·mcp