爬虫学习(三)用beautiful 解析html


安装库



py 复制代码
import  requests
from bs4 import BeautifulSoup
headers = {
    "User-Agent" : "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/119.0.0.0 Safari/537.36 Edg/119.0.0.0"

}
for start_num in range(0,250,25):

    response = requests.get(f"https://movie.douban.com/top250?start={start_num}",headers = headers)
    html = response.text
    soup = BeautifulSoup(html,"html.parser")
    all_title = soup.findAll("span",attrs={"class":"title"})
    for title in all_title:
        title_string = title.string
        if "/" not in title_string:
            print(title_string)
相关推荐
kdxiaojie1 天前
Linux USB驱动阅读笔记(1)
linux·笔记·学习·usb
呼噜想睡觉1 天前
Bootstrap3完成从导航到页脚完整页面开发
学习
深蓝海拓1 天前
基于QtPy (PySide6) 的PLC-HMI工程项目(十五)后续完善和改进:PLC端数据解析的防粘包、残包、废包、拆包
笔记·学习·plc
小黄蚁1 天前
LVGL学习笔记(六)
笔记·学习
zyf1044161 天前
暑期实践日志 Day33:整体复盘核查视频,完善剪辑成果
学习·计算机网络·剪辑·暑期实践·课题任务
01_ice1 天前
前端学习css
前端·css·学习
for_ever_love__1 天前
PySpark学习: 数据输出
开发语言·python·学习·spark
liulilittle1 天前
llmx 学习手册 06 —— CPU 指令集优化(AVX-512 三层演进)
c++·学习·算法·ai·llm
XiaQ09191 天前
Linux 常用命令学习笔记(权限管理篇):看懂 rwx,管好每一份文件的生杀大权
linux·笔记·学习
hsjiasb1 天前
FreeRTOS学习(三十八)——性能优化
学习·学习笔记·freertos