import requests
from bs4 import BeautifulSoup
def get_actors():
actor_list = []
for i in range(0,10):
link = "http://movie.douban.com/top250?start="+str(i*25)
header = {"User-Agent": "Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/94.0.4606.71 Safari/537.36 SE 2.X MetaSr 1.0","Host":"movie.douban.com" }
response = requests.get(link,headers = header)
#print(response.status_code)
soup = BeautifulSoup(response.text,"html.parser")
div_list = soup.find_all('div',class_='bd')
for each in div_list:
actor = each.p.text.strip()
actor_list.append(actor)
return actor_list
actors = get_actors()
print(actors)
第一个爬虫:获取演员表
FrankHuang8882024-04-27 15:07
相关推荐
川冰ICE14 小时前
Python爬虫实战⑳|Pandas时间序列,趋势分析一网打尽小白学大数据15 小时前
Python 爬虫动态 JS 渲染与无头浏览器实战选型指南WL_Aurora16 小时前
Python爬虫实战(三):水果行情网站大规模分页爬取Pocker_Spades_A16 小时前
Python快速入门专业版(五十八)——正则表达式(re):爬虫文本提取利器(从语法到实战)onebound_noah20 小时前
1688商品获取全解析:API与爬虫双轨实战指南跨境数据猎手21 小时前
跨境电商平台系统开发全流程深邃-1 天前
【Web安全】-BurpSutie实战讲解(2):BP代理模块,BP重放模块,BP爆破模块,BP爬虫功能,BP解码模块,BP对比模块MwEUwQ3Gx1 天前
网络爬虫是自动从互联网上采集数据的程序ccchen8881 天前
Discuz X5.0 免登录采集发布插件 - 免费使用指南