python爬虫获取豆瓣前top250的标题(简单)

今天是简略的一篇,简单小实验

python 复制代码
import requests
from bs4 import BeautifulSoup

# 模拟浏览器的构成(请求头)
headers = {
    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/123.0.0.0 Safari/537.36 Edg/123.0.0.0"
}

for start_num in range(0,250,25):
    # 获取豆瓣top榜上前250部电影的响应内容
    response = requests.get(f"https://movie.douban.com/top250?start={start_num}", headers=headers)
    html = response.text
    # 传入方法,指定解析器为html.parser"
    soup = BeautifulSoup(html, "html.parser")
    all_titles=soup.findAll("span",attrs={"class":"title"})
    for title in all_titles:
        title_string=title.string
        if "/" not in title_string:
            print(title_string)

读取:

相关推荐
Livia要学习3 分钟前
Python面向对象三大特性:封装、继承、多态
开发语言·python
dalong107 分钟前
Savitzky-Golay 的C# 实现
开发语言·kotlin·c#
Csvn14 分钟前
🐍 Day1 : Python 环境搭建 — 现代 Python 工作流
后端·python
杨_晨16 分钟前
LLM输出康熙部首冲突
数据库·python·mysql·ai
渣男教父18 分钟前
Python-lxml 与 XPath 实战
python·编程语言
42tr_k21 分钟前
用 OpenDataLoader PDF 搭一个兼容 MinerU 的解析服务
后端·python
show43335 分钟前
多格式导出怎么做?2026免费小程序TXT/SRT实践
开发语言·小程序·c#
circuitsosk35 分钟前
长文本与高并发下的Token“瘦身”策略:Prompt压缩与上下文窗口优化
java·前端·python·prompt·上下文窗口·token优化
岁岁养乐多38 分钟前
LangChain4j 工厂模式
java·开发语言
小小龙学IT1 小时前
Day 28 项目调试与优化 —— 给聊天室做一次“全面体检“
c语言·开发语言