小红书话题内容 API
POST
接口健康状态
暂时读不到健康数据,无法判断这个接口近期的状态。这不代表它不可用。
话题内容:返回列表,每次一页、每页最多 20 条,条数不固定(短页不代表到底),要更多就把结果行里的 next_page_token 作为 page_token 再调,没有 next_page_token 才是到底;limit 照收但不起作用;主要字段 id、url、title、text、like_count、collect_count。支持翻页:把响应里的 next_page_token 作为 page_token 传回拿下一页,其他参数不变,每页算一次调用。
单价 $5.56 / 千次(每次 $0.005556),失败与空结果不扣费。 同步返回;慢任务可在请求体加 "mode": "async",先拿 job_id 再轮询。
请求参数
| 参数名 | 位置 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|---|
Authorization | header | string | 是 | - | Bearer 加你的 API Key。在控制台创建;不要放进网址或代码仓库。 |
platform | body | string | 是 | xiaohongshu | 平台标识,固定值。 |
action | body | string | 是 | hashtag | 能力标识,固定值。 |
topic_id | body.params | 未声明 | 是 | - | hashtag 的话题页 ID(24 位),或话题页链接(https://www.xiaohongshu.com/page/topics/<ID>、App 话题链接、小红书分享短链)。可以直接用 note 返回的 topics[].topic_id;注意不是笔记标签对象自己的 id,也不是话题名称。 |
page_token | body.params | 未声明 | 否 | - | 翻页游标(comments、sub_comments、search、user_posts、search_users、hashtag):把上一次返回结果行里的 next_page_token 原样传入就拿下一页;不传从第一页开始。每页算一次调用,按次计费。 |
sort | body.params | enum | 否 | - | 话题页笔记的排序:newest 最新在前(不传时同此)、popular 最热在前。翻页时保持同一个取值。允许值newestpopular |
代码示例
text
我想用 EveryInfra API 的「话题内容」(xiaohongshu/hashtag)采集数据。请你当我的数据采集助手,按下面三步来。
第一步:先不要写代码。一轮一轮地问我,每次只问 1–3 个问题,直到下面这些都清楚:
1. 这些数据拿来做什么(决定要哪些字段、要多少);
2. 具体采哪些对象:关键词、链接还是 ID,一共多少个;
3. 要多少条、要不要翻页、时间范围;
4. 需要哪些字段(先查文末目录里有哪些字段,再问我);
5. 结果存成什么:CSV、Excel、JSON 还是数据库,存在哪里;
6. 脚本用什么语言、在哪里运行,跑一次还是定时跑;
7. 这次最多愿意花多少钱。
我答得含糊或前后矛盾,就继续追问;我说不知道,就给出建议让我确认。
第二步:写代码前,先把方案讲给我确认:要发哪些请求、大约调用多少次、按目录价格大约花多少钱、结果长什么样。
第三步:我确认后再写脚本,并遵守下面的接口约定:
- 请求:POST https://api.everyinfra.com/api/v1/social
- 鉴权:请求头 Authorization: Bearer <API Key>,Key 从环境变量 EVERYINFRA_API_KEY 读取,不要写进代码、日志或提交记录。
- 请求体示例(字段名和取值按原样使用):
{
"platform": "xiaohongshu",
"action": "hashtag",
"params": {
"topic_id": "5be3ef92a514290001a15147"
}
}
- 慢任务或数据量大时,在请求体加 "mode": "async":接口先返回 202 和 job_id,再轮询 GET https://api.everyinfra.com/api/v1/jobs/{job_id},直到 status 为 succeeded 或 failed。202 不是成功。同步请求返回超时错误时,加上 "mode": "async" 重发同一个请求。
- 结果里有 next_page_token 时,把它作为 page_token 传回拿下一页,其他参数不变;每页算一次调用。
- 失败或空结果不形成最终扣费,已预扣的会自动退回;以响应里的 billing 和 refund 字段为准。
- 返回 422 时,按错误信息里的候选参数名和允许值修正,不要自行猜测参数。
- 返回 429 或 503 时,按 Retry-After 等待后再试;没有 Retry-After 就逐步拉长间隔。
- 网络中断或结果未知时,保留 request_id / job_id 并先查询,不要自动重发请求。
- 参数、允许值、字段和价格:GET https://api.everyinfra.com/api/v1/social/catalog?platform=xiaohongshu(不需要 Key)[OpenAPI 定义 (JSON)]示例从环境变量 EVERYINFRA_API_KEY 读取 Key,复制出去的代码不含你的 Key。
响应示例
字段预览
这组示例参数还没有真实样例:这里只按契约列出响应结构和字段,值用 … 占位,不是一次真实调用的结果。
json
{
"id": "req_…",
"platform": "xiaohongshu",
"action": "hashtag",
"results": [
{
"id": …,
"url": …,
"title": …,
"text": …,
"like_count": …,
"collect_count": …,
"comment_count": …,
"share_count": …,
"posted_at": …,
"image_url": …,
"author_name": …,
"author_id": …,
"avatar_url": …,
"author_url": …,
"is_video": …,
"next_page_token": …,
"video_url": …,
"duration_sec": …,
"platform": …,
"images": …
}
],
"count": …,
"billing": { … },
"quota": { … }
}返回字段
业务数据在 results 里;下表是每条记录可能包含的字段,平台没有提供的值不会被补造。
| 字段 | 含义 |
|---|---|
id | 该记录在原平台上的唯一标识。仅在同一平台内唯一,跨平台可能重复。 |
url本平台特有 | 该记录在小红书上的链接。search、note、profile、hashtag 返回的链接一般带访问令牌,未登录的浏览器也能打开(令牌有时效,过期后重新调用即可);user_posts 返回的笔记链接不带令牌,在浏览器里打开需要令牌:用笔记 ID 调 note 能拿到可以打开的链接;search_users 返回的主页链接同样不带令牌,用 user_id 调 profile 拿能打开的链接。 |
title | 标题。平台无标题概念时(如纯文本帖)为 null。 |
text本平台特有 | 笔记正文或评论内容。note、hashtag 返回笔记全文;search、user_posts 返回的笔记正文可能是截断的摘要(分别约 60 字、100 字以内),要全文用笔记 ID 调 note。 |
like_count本平台特有 | 点赞数。笔记、评论类结果是这条内容的点赞数;profile 里是该账号所有笔记累计获得的点赞数。null 表示不公开或这次没拿到,不等于 0。 |
collect_count本平台特有 | 收藏数。笔记类结果是这篇笔记被收藏的次数;profile 里是该账号笔记累计被收藏的次数。null 表示不公开或这次没拿到,不等于 0。 |
comment_count | 评论数。null 表示不公开,不等于 0。 |
share_count | 分享/转发数。null 表示不公开,不等于 0。 |
posted_at | 发布时间,ISO 8601 格式、UTC 时区(如 2026-08-07T12:34:56+00:00)。平台只给非标准字符串时原样透传,解析前建议做容错。null 表示平台未公开。 |
image_url | 图片链接。多图能力可能返回 image_urls 数组。 |
author_name | 作者昵称(显示名)。 |
author_id本平台特有 | 作者的用户 ID,可直接传给 profile、user_posts。笔记类结果里是 24 位,与主页链接里的 ID 相同;评论类结果(comments、comments_batch、sub_comments)里多为 29 位的另一种写法。同一个人的两种写法不同,跨批次去重前先用 profile 换成它返回的 user_id。 |
avatar_url | 头像图片链接。部分平台给的是带尺寸参数的 CDN 链接,可能有时效。 |
author_url本平台特有 | 作者主页链接,不带访问令牌,未登录的浏览器打不开;用 author_id 调 profile 返回的 url 可以直接打开。 |
is_video | 该条内容是否为视频。 |
next_page_token | 保留平台原语义 |
video_url本平台特有 | 视频播放地址(mp4),带签名、会过期,要留存请及时下载。图文笔记或这次没拿到时为 null。 |
duration_sec本平台特有 | 视频时长,单位秒。图文笔记或这次没拿到时为 null。 |
platform | 数据来源平台标识,与请求里的 platform 一致(如 xiaohongshu、tiktok)。 |
images本平台特有 | 图片链接列表。note、hashtag 是笔记的全部图片(按原顺序);评论类结果(comments、comments_batch、sub_comments)是评论所附的图片,含表情包贴图,没有图片时为空数组。null 表示这次没拿到这一项。 |
错误与计费
- 401
- 缺少 Key 或 Key 无效。先鉴权再校验参数,未鉴权的请求拿不到参数结构。
- 422
- 参数名或取值不对。错误信息会列出这项能力支持的参数、允许值和最接近的候选,按它改即可;发生在扣费之前。
- 402
- 余额不足,请先充值。
- 429
- 超过每分钟请求上限,按 Retry-After 等待后再试。
- 503
- 暂时无法完成。已预扣的费用按原账本退回;响应里的 billing 与 refund 写明实际结果,结果未知时会明确标出,不要直接重发。
- 200 空结果
- 请求完成但没有数据,不扣费(billing.reason = empty_result_refunded)。