爬虫学习(三)用beautiful 解析html


安装库



py 复制代码
import  requests
from bs4 import BeautifulSoup
headers = {
    "User-Agent" : "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/119.0.0.0 Safari/537.36 Edg/119.0.0.0"

}
for start_num in range(0,250,25):

    response = requests.get(f"https://movie.douban.com/top250?start={start_num}",headers = headers)
    html = response.text
    soup = BeautifulSoup(html,"html.parser")
    all_title = soup.findAll("span",attrs={"class":"title"})
    for title in all_title:
        title_string = title.string
        if "/" not in title_string:
            print(title_string)
相关推荐
zbyyd14 分钟前
Linux 进程间通信学习笔记
linux·笔记·学习
一条破秋裤40 分钟前
02_软件安装与新建工程
学习
来了就未晚1 小时前
Python基础 学习代码存储与命名规范
开发语言·python·学习
GHL2842710901 小时前
用codex做一个简单技能学习
学习·ai
西西弗Sisyphus2 小时前
模型训练 不同批次大小与学习率下的训练损失对比(2)
学习·batchsize·lr·learning rate
软件开发技术深度爱好者2 小时前
在线学习实践 TypeScript 的官方Playground(演练场)使用介绍
javascript·学习·typescript
我想我不够好。3 小时前
豹女q w e r衔接闪现
学习
aichitang20244 小时前
希尔伯特空间中的正交性
人工智能·学习·机器学习·ai·泛函分析
for_ever_love__4 小时前
python基础语法学习: 正则表达式
python·学习·正则表达式
佳児素花痴╮5 小时前
STM32U575RIT6(USART)学习
stm32·嵌入式硬件·学习