Python 爬取小红书 文章标题和内容 仅供学习

序言

最近在研究python爬虫,拿小红书实验了一下。供大家学习和借鉴。

研究数据的位置

编写脚本

python 复制代码
from DrissionPage import ChromiumPage
import time

page = ChromiumPage()
# 如果你的 DrissionPage 版本支持,可以指定用户数据目录:
# page = ChromiumPage(user_data_path=r"C:\Users\zgh\AppData\Local\Google\Chrome\User Data")

# 访问页面
url = "https://www.xiaohongshu.com/explore/69f070a9000000001e00d9b3?source=webshare&xhsshare=pc_web&xsec_token=ABJlJI3WKKswIkDhUIvq9Yld9fsbEcqdmAmg5afcsX7K0=&xsec_source=pc_share"
page.get(url)

# 等待页面完全加载
page.wait.doc_loaded()

# 提取数据
note_data = page.run_js('''
        return window.__INITIAL_STATE__.note.noteDetailMap[Object.keys(window.__INITIAL_STATE__.note.noteDetailMap)[0]].note
    ''')

if note_data:
    print(f"标题: {note_data.get('title')}")
    print(f"描述: {note_data.get('desc')}")
else:
    print("提取失败")

效果

原贴

相关推荐
Buke..21 小时前
【APP 逆向】哔哩哔哩 sign 参数逆向(下):OLLVM 混淆还原 sign 算法
java·javascript·爬虫·python·算法
Buke..1 天前
【APP 逆向】哔哩哔哩 sign 参数逆向(上):Frida 反调试绕过与 unidbg 调用
java·开发语言·爬虫·python·安卓
归去来 兮1 天前
Python爬虫爬取数据案例
开发语言·爬虫·python
大鹏说大话2 天前
从爬虫到决策引擎:大数据下自媒体如何用Python挖掘用户痛点
开发语言·爬虫·python
Minner-Scrapy2 天前
Scrapy 2.17 源码解析:Scheduler 调度器与磁盘/内存双队列
java·爬虫·python·scrapy·网络爬虫·twisted
陈皮波比茶2 天前
Python项目实战-网络机器人(爬虫)
开发语言·网络·爬虫·python·机器人
不叫猫先生2 天前
2026 Web Scraping 实战:页面改 class 就归零?用 Bright Data 搭稳定的 Agent 爬虫
爬虫·agent
tang777892 天前
Scrapy框架动态IP自动轮换集成配置教程
爬虫·tcp/ip·scrapy·架构·爬虫代理·动态ip
深蓝电商API2 天前
ECC 加密简介
爬虫·ecc
傻啦嘿哟3 天前
英雄联盟皮肤爬虫:爬取全皮肤价格与特效,做比价工具
java·c++·爬虫