跳到正文

CrawlForge Team工程团队

阅读时长 4 分钟

面向 RevOps 的市场调研 API:一个问题,问遍每一家厂商

RevOps 关于市场的问题,听起来往往很简单。我们这个品类里有多少家厂商公开了免费套餐?谁还在按席位卖?其中哪些把 SSO 锁在企业版里?

答案散落在四十个定价页上。有人一个一个打开,再粘贴进电子表格。一个季度之后,表格已经过时,也没人说得清哪个单元格来自哪里。

面向 RevOps 的市场调研 API 应该把这件事变成一段脚本:一个问题,对每家厂商的页面都问一遍,为每家厂商返回一行,附上回答该问题的那句话。

RevOps 需要什么样的市场调研 API?

市场调研 API 有两种,而在这个关键词下排名靠前的页面,大多卖的是第一种。数据供应商授权的是数据集:企业属性数据、意向信号、市场规模估算。你查询他们的数据库,而数据库里放什么由他们决定。

CrawlForge 属于第二种。它不拥有任何市场数据、公司记录或 TAM 数字。它读取你指给它的公开页面。所以当答案就公布在厂商自己的网站上、而任何数据集都没有对应的字段时,它就是合适的工具:产品打包方式、套餐限额,以及哪些功能放在哪一档套餐里。

怎样对整个品类问同一个问题?

使用带 question 格式的 scrape。托管 API 在这里不运行任何模型。它按你的问题给页面中的句子排序,原样返回最好的五句,每句都带有在页面 markdown 中的偏移量。

Bash
curl -X POST https://crawlforge.dev/api/v1/tools/scrape \
  -H "X-API-Key: cf_live_YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "url": "https://vendor-a.com/pricing",
    "formats": [
      "markdown",
      { "type": "question", "question": "Is SSO included on every plan or only on enterprise?" }
    ]
  }'

答案在 formats.answer.evidence 里:最多五句,每句都有 score、offset 和 length。在同一次调用里请求 markdown 不额外收费,还能让你读到每个偏移量前后的内容。

把它跑遍你的厂商列表,每家厂商写一行:URL、问题、排名最高的证据、检查日期。在 n8n 里,这就是循环中的一个 HTTP Request 节点;n8n 的配置方法见文档。

为什么不让模型直接写答案?

因为事后没人能审计那个单元格。模型可能在某一行填上页面从未写过的价格,而假的看起来和真的一模一样。尽职调查那篇文章详细讲了这种失败。当这一行要喂给交易审批台(Deal Desk)的折扣政策时,这一点同样要紧。

抽取式的答案没那么方便,但更容易审计。你拿到的是排好序的段落,而不是结论。我们拿自己的定价页问有没有免费额度,排第一的句子是 "That's the free tier."(这就是免费额度。)它是对的,但离开它的偏移量所指向的上下文,它什么也说明不了。把证据当作定位器。由一个人,或者一个只读这五句话的模型,来填写单元格,出处原句则放在同一行的旁边。

有两个限制需要提前规划。托管 API 会把表格拍平成文本,所以只出现在价格表格里的价格,返回时是一串单元格,而不是整齐的一行;MCP server 会保留完整的表格行。另外,每次调用只问一个问题,这样每一行都对应一个问题。

做一次品类调研要花多少?

question 格式在 scrape 的 2 credits 之上加 1 credit,所以每个页面 3 credits。

调研页面数问题数credits
一个问题,一个品类401120
定价与打包方式全面过一遍403360
同样一遍,按季度做一年403 × 41,440

免费额度里一次性的 1,000 credits 够完整地做两遍定价与打包方式调研,还有剩余。

它不会做什么?

它不会估算市场规模,也不会告诉你谁在购买。如果问题是 EMEA 有多少家公司员工超过 200 人,那就去买数据集。它也不会在两次调研之间盯着这些页面。对于"竞争对手一改定价就通知我"这类需求,请用托管监控;按账户建立的公司档案则属于数据增强流水线。

免费开始,赠送 1,000 credits,在围绕它搭建任何东西之前,先对你的品类跑一个问题。

亲自试一试——无需注册

在 Playground 中探索全部 31 个 CrawlForge 抓取与提取工具,然后免费开始,获取 1,000 credits。

1,000 免费 credits • 一次性 • 无需信用卡

标签

  • revops
  • market research
  • scrape
  • b2b
  • pricing research

关于作者

CrawlForge Team

工程团队

我们正在打造功能最全面的 Web 抓取 MCP server。我们开发的工具帮助开发者为 AI 应用提取、分析和转换 Web 数据。

邮件订阅

及时获取最新洞察

将教程、产品更新与 Web 抓取技巧直接发送到你的收件箱。

拒绝垃圾邮件,随时可取消订阅。

FAQ

常见问题

01CrawlForge 是市场调研数据提供商吗?

不是。它不拥有任何市场数据:没有企业属性数据、意向信号、市场规模估算,也没有联系人记录。它读取你指给它的公开页面,并返回页面上写了什么。对 RevOps 来说,这让它成为一个调研层,专门回答那些在厂商自己网站上就有答案的问题,比如产品打包方式、套餐限额和功能分档,与你已经授权使用的数据集配合使用。

02question 格式会用到 LLM 吗?

在托管的 REST API 上不会。在那里它只以抽取模式运行:按你的问题给页面中的句子排序,原样返回最好的五句,每句都带有在页面 markdown 中的偏移量和长度。请求 mode "model" 会被以 400 拒绝,且不收取任何费用。模型模式在 MCP server 上可用,它可以调用本地的 Ollama 模型或已配置的 LLM 提供商。

03怎样找到一个品类里每家厂商的定价页?

如果你已经有厂商的域名,map_site 花 2 credits 就能列出一个网站的 URL,你可以从中挑出定价页,不必去猜路径。如果你还在弄清楚这个品类里有哪些厂商,search_web 每次查询 5 credits,deep_research 每次运行 10 credits,并为每条发现返回来源 URL。

04我能从 n8n 或其他工作流工具里运行这次调研吗?

可以。每个工具都是 REST API 上一个普通的 POST 端点,用 X-API-Key 请求头认证,所以 n8n 里的 HTTP Request 节点,或者 Make、Zapier 里的对应步骤,都可以在遍历厂商列表的循环里调用它。走 REST 路径时不需要自托管任何东西。

继续阅读

相关文章