RevOps 关于市场的问题,听起来往往很简单。我们这个品类里有多少家厂商公开了免费套餐?谁还在按席位卖?其中哪些把 SSO 锁在企业版里?
答案散落在四十个定价页上。有人一个一个打开,再粘贴进电子表格。一个季度之后,表格已经过时,也没人说得清哪个单元格来自哪里。
面向 RevOps 的市场调研 API 应该把这件事变成一段脚本:一个问题,对每家厂商的页面都问一遍,为每家厂商返回一行,附上回答该问题的那句话。
RevOps 需要什么样的市场调研 API?
市场调研 API 有两种,而在这个关键词下排名靠前的页面,大多卖的是第一种。数据供应商授权的是数据集:企业属性数据、意向信号、市场规模估算。你查询他们的数据库,而数据库里放什么由他们决定。
CrawlForge 属于第二种。它不拥有任何市场数据、公司记录或 TAM 数字。它读取你指给它的公开页面。所以当答案就公布在厂商自己的网站上、而任何数据集都没有对应的字段时,它就是合适的工具:产品打包方式、套餐限额,以及哪些功能放在哪一档套餐里。
怎样对整个品类问同一个问题?
使用带 question 格式的 scrape。托管 API 在这里不运行任何模型。它按你的问题给页面中的句子排序,原样返回最好的五句,每句都带有在页面 markdown 中的偏移量。
curl -X POST https://crawlforge.dev/api/v1/tools/scrape \
-H "X-API-Key: cf_live_YOUR_KEY" \
-H "Content-Type: application/json" \
-d '{
"url": "https://vendor-a.com/pricing",
"formats": [
"markdown",
{ "type": "question", "question": "Is SSO included on every plan or only on enterprise?" }
]
}'答案在 formats.answer.evidence 里:最多五句,每句都有 score、offset 和 length。在同一次调用里请求 markdown 不额外收费,还能让你读到每个偏移量前后的内容。
把它跑遍你的厂商列表,每家厂商写一行:URL、问题、排名最高的证据、检查日期。在 n8n 里,这就是循环中的一个 HTTP Request 节点;n8n 的配置方法见文档。
为什么不让模型直接写答案?
因为事后没人能审计那个单元格。模型可能在某一行填上页面从未写过的价格,而假的看起来和真的一模一样。尽职调查那篇文章详细讲了这种失败。当这一行要喂给交易审批台(Deal Desk)的折扣政策时,这一点同样要紧。
抽取式的答案没那么方便,但更容易审计。你拿到的是排好序的段落,而不是结论。我们拿自己的定价页问有没有免费额度,排第一的句子是 "That's the free tier."(这就是免费额度。)它是对的,但离开它的偏移量所指向的上下文,它什么也说明不了。把证据当作定位器。由一个人,或者一个只读这五句话的模型,来填写单元格,出处原句则放在同一行的旁边。
有两个限制需要提前规划。托管 API 会把表格拍平成文本,所以只出现在价格表格里的价格,返回时是一串单元格,而不是整齐的一行;MCP server 会保留完整的表格行。另外,每次调用只问一个问题,这样每一行都对应一个问题。
做一次品类调研要花多少?
question 格式在 scrape 的 2 credits 之上加 1 credit,所以每个页面 3 credits。
| 调研 | 页面数 | 问题数 | credits |
|---|---|---|---|
| 一个问题,一个品类 | 40 | 1 | 120 |
| 定价与打包方式全面过一遍 | 40 | 3 | 360 |
| 同样一遍,按季度做一年 | 40 | 3 × 4 | 1,440 |
免费额度里一次性的 1,000 credits 够完整地做两遍定价与打包方式调研,还有剩余。
它不会做什么?
它不会估算市场规模,也不会告诉你谁在购买。如果问题是 EMEA 有多少家公司员工超过 200 人,那就去买数据集。它也不会在两次调研之间盯着这些页面。对于"竞争对手一改定价就通知我"这类需求,请用托管监控;按账户建立的公司档案则属于数据增强流水线。
免费开始,赠送 1,000 credits,在围绕它搭建任何东西之前,先对你的品类跑一个问题。