竞争情报
借助隐身浏览与结构化提取,隐蔽地收集竞争对手数据。
快速解答
用 CrawlForge stealth_mode(5 credits)轮换住宅代理并随机化浏览器指纹,绕过 CAPTCHA、速率限制和机器人检测,再用 scrape_structured(2 credits)将选择器映射为带类型的 JSON——产品名称、价格、规格。您可以按计划监控受保护的竞争对手页面,而无需自行运营代理基础设施。
面临的问题
竞争对手网站会通过验证码、限速和机器人检测主动屏蔽抓取程序。从受保护的网站获取可靠、结构化的数据,需要昂贵的代理基础设施和持续的维护。
解决方案
CrawlForge 的 stealth_mode 使用住宅代理和浏览器指纹轮换来绕过反爬系统。再搭配 scrape_structured,即可实现干净、基于 schema 的数据提取。
代码示例
// Gather competitor data through anti-bot protections
const page = await mcp.stealth_mode({
url: "https://competitor.com/pricing",
proxy: "residential",
fingerprint: "randomize",
});
// Extract structured pricing data
const pricing = await mcp.scrape_structured({
url: "https://competitor.com/pricing",
schema: {
plans: [{
name: "string",
price: "string",
features: ["string"],
}],
},
});
console.log(pricing.plans);使用的工具
预估费用:每个受保护页面约 7 credits
常见问题
如何爬取那些屏蔽机器人的竞争对手网站?
使用 CrawlForge 的 stealth_mode,它会轮换住宅代理并随机化浏览器指纹,从而绕过 CAPTCHA、速率限制和机器人检测。将它与 scrape_structured 结合,即可从这些受保护的页面中返回干净的、基于 schema 的数据。
隐身爬取的可靠性足以支撑持续监控吗?
足够。stealth_mode 会替你处理代理轮换和指纹伪装,因此你可以按计划监控受保护的竞争对手页面,而无需自行搭建代理基础设施。再搭配 track_changes,就能盯住产品发布或价格调整。
stealth_mode 每次请求的成本是多少?
stealth_mode 每次请求为 5 credits,因为它会运行一个完整的浏览器并轮换代理和指纹。请把它留给那些确实会屏蔽标准抓取的网站,对于开放页面则使用更便宜的工具,比如 1 credit 的 fetch_url。
我能从竞争对手的页面提取结构化数据吗?
可以。scrape_structured 为 2 credits,它将 CSS 选择器映射到字段,让你得到带类型的 JSON——产品名称、价格、规格——而不是原始的 HTML。若想在不使用选择器的情况下进行 AI 驱动的提取,可使用 3 credits 的 extract_structured。