获取小红书某个用户列表

from playwright.sync_api import sync_playwright

import time

cookie=[] #用自己的cookie

def capture_response(response, url_to_capture, api_response_data):

检查响应的 URL 是否匹配

if url_to_capture in response.url:

检查是否是 JSON 格式

if 'application/json' in response.headers.get('content-type', ''):

api_response_data.append(response.json()) # 将 JSON 数据添加到列表中

p = sync_playwright().start()

browser = p.chromium.launch(headless=True)

context = browser.new_context()

context.add_cookies(cookie)

page = context.new_page()

api_response_data = []

url_to_capture = 'https://edith.xiaohongshu.com/api/sns/web/v1/search/usersearch'

page.on('response', lambda response: capture_response(response, url_to_capture, api_response_data))

page.goto("https://www.xiaohongshu.com/search_result/?keyword=%25E5%25B0%258F%25E4%25B9%258C%25E8%258B%258F\&source=web_explore_feed\&type=51")

page.wait_for_load_state('load')

page.locator('//div[text()=" 用户"]').click()

page.wait_for_event('response')

#page.wait_for_timeout(3000)

while True:

page.mouse.wheel(0, 1000)

#page.wait_for_timeout(1000)

try:

page.wait_for_selector('//div[text()=" - THE END - "]',timeout=50)

print("下拉结束")

break

except Exception as e:

print("继续下拉")

pass

page.wait_for_load_state('load')

#print(page.content())

print(len(api_response_data))

#browser.close()

for k in api_response_data:

for i in k['data']['users']:

print(i['name'])

print(i['sub_title'])

print(i['image'])

print("====================================")

相关推荐
大明者省34 分钟前
Pycharm2025.2终端出现PS,无法切换到当前虚拟环境
人工智能·python
啵啵鱼爱吃小猫咪1 小时前
pycharm跑python项目易出错的问题
ide·python·pycharm
Learn Beyond Limits1 小时前
Initializing K-means|初始化K-means
人工智能·python·算法·机器学习·ai·kmeans·吴恩达
Wah-Aug1 小时前
PyTorch 模型评估与全局平均池化的应用实践
人工智能·pytorch·python
菠萝吹雪ing1 小时前
pytest中的assert断言
python·pytest
倔强青铜三1 小时前
苦练Python第56天:元类•描述符•异步•Pickle 的 28 个魔术方法——从入门到精通
人工智能·python·面试
倔强青铜三2 小时前
苦练Python第55天:容器协议的七个魔术方法从入门到精通
人工智能·python·面试
伊织code2 小时前
LLM - 命令行与Python库的大语言模型交互工具
开发语言·python·语言模型
春生黎至10052 小时前
Python列表
开发语言·python
愈努力俞幸运2 小时前
socket编程 netstat 大小端 rpc 协程 io yield
网络·python·网络协议·rpc