返回博客

小红书蒲公英数据 API:博主选号、粉丝画像、笔记转化率一站取数

Rnote API 团队 · · 2091 次阅读 · English
小红书蒲公英 蒲公英API 博主数据 达人选号 粉丝画像 达人投放

做小红书投放、达人筛选、内容竞品分析,最有价值的数据往往在蒲公英(小红书官方创作者商业合作平台)里:博主的真实粉丝画像、笔记转化率、报价、互动中位数、粉丝增长趋势……这些数据在普通爬虫接口里拿不到。Rnote API 新上线的蒲公英数据接口把这些能力封装成标准 REST 接口,按需调用、仅成功扣费。

蒲公英数据接口能拿到什么?

一组覆盖「笔记 → 博主 → 选号」的接口:

  • 笔记详情 POST /api/v2/pgy/note/detail — 单篇笔记的正文、图文/视频媒体、曝光/阅读/点赞/收藏/评论。
  • 博主详情 POST /api/v2/pgy/blogger/detail — 昵称、小红书号、地区、标签、粉丝数、获赞收藏、图文/视频合作报价、合作状态。
  • 博主笔记明细 POST /api/v2/pgy/blogger/notes — 分页拉取博主笔记,每条含阅读/点赞/收藏、是否视频、是否商业合作;支持按笔记类型与排序筛选。
  • 笔记转化率/数据表现 POST /api/v2/pgy/blogger/notes-rate — 曝光/阅读/互动中位数、互动率、完播率、百赞/千赞比例、内容形式占比,以及各项「同行超越率」。
  • 核心数据 POST /api/v2/pgy/blogger/core-data — 逐日趋势 + 区间汇总(曝光/阅读/互动/CPM/CPE)。
  • 数据概览 POST /api/v2/pgy/blogger/data-summary — 成本与报价预估(CPM/CPUV/阅读成本)、内容形式占比、月粉丝增长、合作行业。
  • 粉丝概览 / 画像 / 增长 — 粉丝量与活跃/互动/付费粉丝、年龄性别地域兴趣设备画像、逐日粉丝增长曲线。
  • 博主列表(选号) POST /api/v2/pgy/blogger/list — 按品牌维度 + 粉丝量筛选候选博主,批量选号。

典型用途

  • 达人投放选号:用「博主列表」按品牌与粉丝量筛人,再用「博主详情 + 转化率 + 粉丝画像」做尽调,挑出最匹配的博主。
  • 粉丝画像匹配:拿粉丝的年龄/性别/地域/兴趣分布,判断博主受众是否与品牌目标人群一致。
  • 报价与性价比评估:对比图文/视频报价与阅读成本、互动中位数,算清楚每一分预算的效率。
  • 竞品与行业分析:批量拉取对手合作博主的核心数据与趋势,复盘投放策略。

怎么用

  1. 免费注册并在后台创建 API Key(新账号默认即开通爬虫与蒲公英接口权限)。
  2. 用 X-API-Key 调用 /api/v2/pgy/*,请求体只需业务参数(如 user_id、note_id、分页、笔记类型)。
  3. 在 API 文档 的 Swagger 里点 Authorize 即可在线试调,每个接口都标注了参数取值与返回字段。

计费

蒲公英接口按次计费、仅业务成功才扣费,失败(如限流、参数错误)不计费。具体单价见定价页。

后来新增的接口

这篇最初上线时覆盖的是「笔记 → 博主 → 选号」这条主线。之后陆续补了几组,把投放前的内容判断也接了进来:

  • 内容广场 POST /api/v2/pgy/content/square — 按类目拉平台侧的内容分布,看这个赛道大家都在讲什么,而不只是你搜的那个词。
  • 关键词分析 keyword/stat / keyword/daily / keyword/related — 分别是整体表现、按天趋势、相关词扩展。做内容规划时先看 keyword/daily:押正在涨的词,而不是已经很高的词。
  • 直播博主广场 POST /api/v2/pgy/live-blogger/list — 做直播带货选号用。注意它和笔记博主广场 blogger/list 是两个不同的池子,用后者筛出来的账号未必开播。
  • 相似博主 POST /api/v2/pgy/blogger/similar — 从一个已验证有效的合作方出发找"下一个类似的",比重新筛一遍类目快得多。
  • 笔记精选评论 / 笔记组件 note/comments / note/components — 看这条商业笔记下的真实反馈与挂载的组件。
  • 跨域笔记案例 POST /api/v2/pgy/blogger/notes_v2 — 原生的 blogger/notes 对跨域博主会返回空,这时改用 notes_v2。两个接口的字段结构不同,不能混用。

分页与每页上限

每页数量上限跟着蒲公英网页端的实际值走,不同接口不一样,传超了不会给你更多数据,只会被截断。具体上限和翻页方式见文档——这一节值得在写循环之前花两分钟读一遍,能省掉一轮"为什么只回来这么点"的排查。

一条完整的选号链路

把这些接口串起来,一次投放前的选号大致是这样:

1. keyword/related + keyword/daily   定方向:哪些词正在涨
2. content/square                    看这些方向下现在跑得好的内容形式
3. blogger/list                      按类目和粉丝区间拉候选池
4. fans-profile                      按城市/年龄硬性淘汰(这一步砍掉大半)
5. notes-rate                        看互动率,淘汰"粉丝对但没人看"的
6. fans-history                      对剩下的做尽调,看增长曲线形状
7. blogger/detail                    最后才取报价,算单位有效触达成本
8. blogger/similar                   合作跑出效果后,找下一批相似账号

顺序有讲究:取报价放在最后。报价接口通常是这套里最贵的一个,拿它去筛人是纯粹的浪费;先用画像和互动率把池子砍小,再对剩下的取价。

前三步的详细读法见《蒲公英内容广场与关键词分析》,四到六步见《蒲公英粉丝画像怎么读》。

常见问题

Q:和普通爬虫接口有什么区别? A:普通接口拿的是公开的笔记/用户/搜索数据;蒲公英接口拿的是官方商业合作平台里的博主商业数据(报价、转化率、粉丝画像等),是做投放决策的关键数据。

Q:需要自己准备账号 / Cookie 吗? A:不需要。服务端维护账号池并自动调度、限速、轮换,你只管用 API Key 调接口。

Q:稳定吗? A:内置健康调度、限速与冷却机制,独立于其他爬虫服务运行,互不影响。

开始使用

免费注册 → 创建 API Key → 调用 /api/v2/pgy/*。详见定价与接口文档。