python爬虫获取豆瓣前top250的标题(简单)

今天是简略的一篇,简单小实验

python 复制代码
import requests
from bs4 import BeautifulSoup

# 模拟浏览器的构成(请求头)
headers = {
    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/123.0.0.0 Safari/537.36 Edg/123.0.0.0"
}

for start_num in range(0,250,25):
    # 获取豆瓣top榜上前250部电影的响应内容
    response = requests.get(f"https://movie.douban.com/top250?start={start_num}", headers=headers)
    html = response.text
    # 传入方法,指定解析器为html.parser"
    soup = BeautifulSoup(html, "html.parser")
    all_titles=soup.findAll("span",attrs={"class":"title"})
    for title in all_titles:
        title_string=title.string
        if "/" not in title_string:
            print(title_string)

读取:

相关推荐
AI玫瑰助手几秒前
Python函数:内置函数(len/max/min/sorted等)详解
android·开发语言·python
ziyitty4 分钟前
解决Windows下Bash调用Python输出中文乱码的问题
windows·python·bash
栈溢出了5 分钟前
torch.gather 用法笔记
pytorch·python·深度学习
咸鱼翻身小阿橙8 分钟前
C# WinForms 控件学习项目
开发语言·学习·c#
右耳朵猫AI9 分钟前
Go周刊2026W22 | GoReleaser 2.16、chi 5.3、tldx 1.4、wazero 1.12、Buf 1.70
开发语言·后端·golang
杨超越luckly12 分钟前
Agent应用指南:利用GET请求获取赛力斯汽车门店位置信息
python·html·汽车·可视化·门店
AI人工智能+电脑小能手14 分钟前
【大白话说Java面试题 第105题】【并发篇】第5题:说一下 synchronized 关键字的底层原理?
java·开发语言·面试
花月C15 分钟前
Agent上下文三级压缩
python·prompt·ai编程
yueping216 分钟前
【无标题】
java·开发语言
踏着七彩祥云的小丑22 分钟前
Go学习第3天:变量+常量+运算符
开发语言·学习·golang·go