import requests
from bs4 import BeautifulSoup
def get_actors():
actor_list = []
for i in range(0,10):
link = "http://movie.douban.com/top250?start="+str(i*25)
header = {"User-Agent": "Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/94.0.4606.71 Safari/537.36 SE 2.X MetaSr 1.0","Host":"movie.douban.com" }
response = requests.get(link,headers = header)
#print(response.status_code)
soup = BeautifulSoup(response.text,"html.parser")
div_list = soup.find_all('div',class_='bd')
for each in div_list:
actor = each.p.text.strip()
actor_list.append(actor)
return actor_list
actors = get_actors()
print(actors)
第一个爬虫:获取演员表
FrankHuang8882024-04-27 15:07
相关推荐
0思必得06 小时前
[Web自动化] Selenium无头模式Libraeking9 小时前
爬虫的“法”与“术”:在牢狱边缘疯狂试探?(附高阶环境配置指南)我是章汕呐10 小时前
拆解Libvio.link爬虫:从动态页面到反爬对抗的实战解析狗都不学爬虫_13 小时前
JS逆向 - 某住会同盾blackbox纯算分析JNU freshman14 小时前
爬虫?先看网站的robots.txt深蓝电商API14 小时前
签名参数逆向:分析 sign 生成算法星川皆无恙15 小时前
豆瓣电影数据爬虫分析:基于 Python 的豆瓣电影数据可视化分析系统IP搭子来一个18 小时前
Python爬虫代理,选短效IP还是长效IP?电商API&Tina19 小时前
【无标题】京东商品评论数据采集权威指南:API 与爬虫实战Blurpath住宅代理19 小时前
了解正向代理和反向代理:通过提升网络性能和安全性