一、核心调用(立即上手)
1. 接口信息(v2 标准)
- 地址:注册接口
- 方法:
GET - 鉴权:
access_token(OAuth2.0,有效期约 2 小时,需刷新) - 签名:参数按 ASCII 排序 +
App Secret做 MD5 - 分页:
page/limit或cursor+has_more
2. 必传参数
note_id:笔记 ID(从 URL / 分享链接提取)access_token:授权令牌timestamp:时间戳(秒级)sign:签名(防篡改)
3. Python 调用示例
python
运行
import requests
import hashlib
import time
def get_xhs_comments(note_id, app_key, app_secret, access_token, page=1, limit=20):
url = f"https://api.xiaohongshu.com/v2/notes/{note_id}/comments"
ts = str(int(time.time()))
# 签名拼接(按ASCII升序)
sign_str = f"app_key{app_key}limit{limit}note_id{note_id}page{page}timestamp{ts}{app_secret}"
sign = hashlib.md5(sign_str.encode()).hexdigest()
params = {
"access_token": access_token,
"app_key": app_key,
"note_id": note_id,
"page": page,
"limit": limit,
"timestamp": ts,
"sign": sign
}
resp = requests.get(url, params=params)
return resp.json() if resp.status_code == 200 else None
二、调用规范与风控(必守)
1. 频率限制(默认)
- 每分钟 ≤ 100 次;超限返回
429 - 优化:缓存 + 重试(指数退避:1s→2s→4s)、批量异步、申请提额
2. 常见错误与处理
表格
| 错误码 | 原因 | 解决方案 |
|---|---|---|
| 401 | 授权过期 / 无效 | 用refresh_token刷新access_token |
| 403 | 权限不足 | 检查应用是否开通评论 API 权限 |
| 404 | 笔记不存在 / 私密 | 核对note_id,确认笔记公开 |
| 429 | 频率超限 | 降频、加缓存、申请提额 |
| 10001 | token 过期 | 刷新授权 |
3. 合规红线(严禁触碰)
- 禁止获取 / 存储用户隐私(手机号、地址等)
- 评论用户 ID 需脱敏(如
user_12345→user_****5) - 数据仅限申请用途,禁止商业营销滥用
- 遵守《个人信息保护法》与小红书开放平台协议
三、数据处理与存储
1. 数据结构(核心字段)
json
{
"code": 0,
"data": {
"comments": [
{
"id": "评论ID",
"content": "评论内容",
"create_time": 1742450000,
"user_info": {
"user_id": "用户ID",
"nickname": "昵称",
"avatar": "头像"
},
"like_count": 点赞数,
"reply_count": 回复数
}
],
"has_more": true,
"total": 123
}
}
2. 处理流程
- 清洗:去重、过滤广告 / 垃圾评论、脱敏
- 结构化:存入 MySQL/PostgreSQL(关系型)或 MongoDB(非结构化)
- 缓存:Redis 缓存高频笔记(TTL≥10 分钟)
- 增量更新:定时拉取新评论,避免全量重复
四、业务落地场景
- 内容分析:情感倾向、关键词云、用户需求挖掘
- 舆情监控:负面预警、竞品评论对比
- 运营优化:高频词优化标题 / 文案、提炼卖点
- 客服自动化:提取疑问→自动回复→私域 SOP
- BI 报表:对接 Tableau/DataEase 做可视化
五、性能与稳定性优化
- 异步请求 :用
aiohttp提升批量效率 - 批量调度:控制并发,避免集中请求
- 监控告警:对接 Prometheus/Grafana,监控 429/500 等异常
- 降级策略:API 不可用时,启用缓存兜底
六、下一步行动清单
- 测试 10 条笔记,验证签名、分页、鉴权
- 搭建数据清洗 + 存储 pipeline
- 配置监控与告警
- 开发 1-2 个核心业务场景(如情感分析)