小红书笔记评论API接通后

一、核心调用(立即上手)

1. 接口信息(v2 标准)
  • 地址:注册接口
  • 方法:GET
  • 鉴权:access_token(OAuth2.0,有效期约 2 小时,需刷新)
  • 签名:参数按 ASCII 排序 + App Secret 做 MD5
  • 分页:page/limitcursor + has_more
2. 必传参数
  • note_id:笔记 ID(从 URL / 分享链接提取)
  • access_token:授权令牌
  • timestamp:时间戳(秒级)
  • sign:签名(防篡改)
3. Python 调用示例

python

运行

复制代码
import requests
import hashlib
import time

def get_xhs_comments(note_id, app_key, app_secret, access_token, page=1, limit=20):
    url = f"https://api.xiaohongshu.com/v2/notes/{note_id}/comments"
    ts = str(int(time.time()))
    # 签名拼接(按ASCII升序)
    sign_str = f"app_key{app_key}limit{limit}note_id{note_id}page{page}timestamp{ts}{app_secret}"
    sign = hashlib.md5(sign_str.encode()).hexdigest()
    params = {
        "access_token": access_token,
        "app_key": app_key,
        "note_id": note_id,
        "page": page,
        "limit": limit,
        "timestamp": ts,
        "sign": sign
    }
    resp = requests.get(url, params=params)
    return resp.json() if resp.status_code == 200 else None

二、调用规范与风控(必守)

1. 频率限制(默认)
  • 每分钟 ≤ 100 次;超限返回429
  • 优化:缓存 + 重试(指数退避:1s→2s→4s)、批量异步、申请提额
2. 常见错误与处理

表格

错误码 原因 解决方案
401 授权过期 / 无效 refresh_token刷新access_token
403 权限不足 检查应用是否开通评论 API 权限
404 笔记不存在 / 私密 核对note_id,确认笔记公开
429 频率超限 降频、加缓存、申请提额
10001 token 过期 刷新授权
3. 合规红线(严禁触碰)
  • 禁止获取 / 存储用户隐私(手机号、地址等)
  • 评论用户 ID 需脱敏(如user_12345user_****5
  • 数据仅限申请用途,禁止商业营销滥用
  • 遵守《个人信息保护法》与小红书开放平台协议

三、数据处理与存储

1. 数据结构(核心字段)

json

复制代码
{
  "code": 0,
  "data": {
    "comments": [
      {
        "id": "评论ID",
        "content": "评论内容",
        "create_time": 1742450000,
        "user_info": {
          "user_id": "用户ID",
          "nickname": "昵称",
          "avatar": "头像"
        },
        "like_count": 点赞数,
        "reply_count": 回复数
      }
    ],
    "has_more": true,
    "total": 123
  }
}
2. 处理流程
  1. 清洗:去重、过滤广告 / 垃圾评论、脱敏
  2. 结构化:存入 MySQL/PostgreSQL(关系型)或 MongoDB(非结构化)
  3. 缓存:Redis 缓存高频笔记(TTL≥10 分钟)
  4. 增量更新:定时拉取新评论,避免全量重复

四、业务落地场景

  • 内容分析:情感倾向、关键词云、用户需求挖掘
  • 舆情监控:负面预警、竞品评论对比
  • 运营优化:高频词优化标题 / 文案、提炼卖点
  • 客服自动化:提取疑问→自动回复→私域 SOP
  • BI 报表:对接 Tableau/DataEase 做可视化

五、性能与稳定性优化

  • 异步请求 :用aiohttp提升批量效率
  • 批量调度:控制并发,避免集中请求
  • 监控告警:对接 Prometheus/Grafana,监控 429/500 等异常
  • 降级策略:API 不可用时,启用缓存兜底

六、下一步行动清单

  1. 测试 10 条笔记,验证签名、分页、鉴权
  2. 搭建数据清洗 + 存储 pipeline
  3. 配置监控与告警
  4. 开发 1-2 个核心业务场景(如情感分析)
相关推荐
RainCity2 天前
Java Swing 自定义组件库分享(十二)
java·笔记·后端
LinXunFeng9 天前
Obsidian - 使用 Share Note 分享笔记并自部署
前端·笔记·github
闪闪发亮的小星星13 天前
高斯光以及高斯光公式解释
笔记
cqbzcsq13 天前
CellFlow虚拟细胞论文阅读
论文阅读·人工智能·笔记·学习·生物信息
阿米亚波13 天前
【Windows】QEMU 启动 openEuler aarch64/arm64 架构系统 + 离线软件源
linux·windows·经验分享·笔记·架构·arm
自传.13 天前
尚硅谷 Vibe Coding|第三章(1) Claude Code深度使用与进阶技巧 学习笔记
笔记·学习·尚硅谷·vibecoding
.千余13 天前
【C++】模板进阶全解:非类型参数|全特化|偏特化|分离编译完全指南
开发语言·c++·笔记·学习·其他
自传.13 天前
尚硅谷 Vibe Coding|第二章 AI编程工具生态 学习笔记
笔记·学习·ai编程·尚硅谷·vibe coding
秋波。未央14 天前
Java Agent 开发 · Day 1 学习笔记(含作业完整标准答案)
java·笔记·学习
中屹指纹浏览器14 天前
2026指纹浏览器字体指纹、字体渲染偏差检测与全维度虚拟字体池搭建方案
经验分享·笔记