CrawlForge MCP
AI 工具3 credits

extract_with_llm

AI 驱动的提取,默认运行在本地 Ollama 模型上 —— 无需 LLM API key。需要托管模型时,可选择路由到 OpenAI 或 Anthropic。给它一个提示词(可选附带 JSON Schema),即可返回结构化数据。

使用场景

本地优先的提取

在自己机器上的 Ollama 上运行提取 —— 零 LLM API 费用,且默认私密。

schema 驱动的数据湖

将提示词与 JSON Schema 结合,为你的数据仓库或图存储填充类型化的行。

多提供方故障转移

从本地 Ollama 开始,仅切换一个参数即可在高风险页面上回退到 OpenAI 或 Anthropic。

Endpoint

POST/api/v1/tools/extract_with_llm
Auth Required
Free 计划 1 req/s
3 credits

Parameters

`provider` 默认为 `"auto"`: 在自行运行的 MCP 服务器上,"auto" 会使用你本地的 Ollama —— 无需 LLM API key。而在托管的 CrawlForge API 上没有本地 Ollama,因此 "openai" 或 "anthropic" 只有在执行后端已配置相应 key 时才可用。
NameTypeRequiredDefaultDescription
url
stringOptional-
要抓取并从中提取的 URL。url 与 content 二选一必填。
Example: https://example.com/article/42
content
stringOptional-
要从中提取的原始文本或 HTML 内容。url 与 content 二选一必填。
Example: "<html>...</html>"
prompt
stringRequired-
指导 LLM 提取的自然语言指令
Example: Extract the headline, author, and three key takeaways
schema
objectOptional-
可选的 JSON Schema,用于描述要提取的数据结构
Example: {"type":"object","properties":{"title":{"type":"string"}},"required":["title"]}
provider
stringOptionalauto
LLM 提供方:"ollama"(本地,默认)、"openai"、"anthropic" 或 "auto"
Example: ollama
model
stringOptional-
模型标识符。各提供方默认值:llama3.2、gpt-4o-mini、claude-haiku-4-5-20251001
Example: llama3.2
maxTokens
numberOptional4096
LLM 响应的最大 token 数
Example: 4096

请求示例

cURL — 本地 Ollama(默认,无需 API key)

terminalBash
curl -X POST https://crawlforge.dev/api/v1/tools/extract_with_llm \
  -H "X-API-Key: cf_test_YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "url": "https://example.com/article/42",
    "prompt": "Extract the headline, author, and three key takeaways",
    "provider": "ollama"
  }'

TypeScript — 带 schema 的 OpenAI

extractWithLlm.tsTypescript
const response = await fetch('https://crawlforge.dev/api/v1/tools/extract_with_llm', {
  method: 'POST',
  headers: {
    'X-API-Key': process.env.CRAWLFORGE_API_KEY!,
    'Content-Type': 'application/json',
  },
  body: JSON.stringify({
    url: 'https://example.com/product/123',
    prompt: 'Extract product name, price in USD, and stock status',
    provider: 'openai',
    model: 'gpt-4o-mini',
    schema: {
      type: 'object',
      properties: {
        title: { type: 'string' },
        price: { type: 'number' },
        in_stock: { type: 'boolean' },
      },
      required: ['title', 'price'],
    },
  }),
});

const data = await response.json();
if (data.success) {
  console.log(data.data.extracted);
}

Python — Anthropic

extract_with_llm.pyPython
import requests, os

response = requests.post(
    'https://crawlforge.dev/api/v1/tools/extract_with_llm',
    headers={
        'X-API-Key': os.environ['CRAWLFORGE_API_KEY'],
        'Content-Type': 'application/json',
    },
    json={
        'url': 'https://example.com/article/42',
        'prompt': 'Extract headline, author, publish date (ISO 8601), and tags',
        'provider': 'anthropic',
        'model': 'claude-haiku-4-5-20251001',
        'schema': {
            'type': 'object',
            'properties': {
                'headline': {'type': 'string'},
                'author': {'type': 'string'},
                'published_at': {'type': 'string'},
                'tags': {'type': 'array'},
            },
            'required': ['headline'],
        },
    },
)

data = response.json()
if data['success']:
    print(data['data']['extracted'])

响应示例

200 OK3.5s
{
"success": true,
"data": {
"extracted": {
"headline": "How Local LLMs Are Changing Data Pipelines",
"author": "Jane Doe",
"takeaways": [
"Lower cost",
"Better privacy",
"Faster iteration"
]
},
"model_used": "llama3.2",
"provider": "ollama"
},
"credits_used": 3,
"credits_remaining": 997,
"processing_time": 3500
}
Field Descriptions
data.provider解析出的提供方 —— 当 provider 为 "auto" 时为 "ollama"
data.model_used除非你指定,否则使用各提供方的默认模型
credits_used无论使用哪个提供方,固定 3 credits

credit 费用

3 credits
每次请求 3 credits
无论使用本地 Ollama、OpenAI 还是 Anthropic,均固定 3 credits。

提示: 在发送提取请求之前,先使用 list_ollama_models 来发现有哪些本地模型可用。

相关工具

list_ollama_models
发现可用的本地 Ollama 模型
extract_structured
schema 驱动的提取,带选择器回退(3 credits)
准备好在自己的机器上运行 LLM 提取了吗?免费注册,获取 1,000 credits。

页脚

CrawlForge MCP

面向 AI Agent 的企业级网页抓取。29 个专业 MCP 工具,专为构建智能系统的现代开发者而设计。

产品

  • 功能
  • Playground
  • 价格
  • 应用场景
  • 集成
  • 替代方案
  • 更新日志

资源

  • 快速上手
  • API 参考
  • 模板
  • 指南
  • 博客
  • 术语表
  • 常见问题
  • 网站地图

开发者

  • MCP 协议
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

公司

  • 关于我们
  • 联系我们
  • 隐私政策
  • 服务条款
  • 可接受使用政策
  • Cookie

保持更新

获取新工具和新功能的最新动态。

基于 Next.js 和 MCP 协议构建

© 2025-2026 CrawlForge。保留所有权利。