Pada halaman ini
Web scraping tidak pernah sepenting ini bagi aplikasi AI. Sama ada anda membina sistem RAG, melatih model, atau mencipta ejen pintar, anda memerlukan akses yang boleh dipercayai kepada data web. CrawlForge MCP menyampaikan 26 alat khusus dalam satu pakej, direka khusus untuk pembangun yang membina dengan Claude dan LLM yang lain.
Mengapa Satu MCP Server Mengubah Segalanya
Penyelesaian scraping tradisional memaksa anda mencantumkan pelbagai alat:
- Pelanggan HTTP asas untuk pengambilan mudah
- Rangka kerja automasi pelayar untuk laman yang berat dengan JavaScript
- Perkhidmatan berasingan untuk carian
- Alat lain untuk pengekstrakan kandungan
- Satu lagi untuk memantau perubahan
Dengan CrawlForge, anda mendapat satu API bersatu dengan pengesahan, harga, dan format respons yang konsisten. Claude boleh memilih alat yang betul untuk setiap tugas secara pintar.
Rujukan Alat yang Lengkap
Alat Asas (1 Credit Setiap Satu)
Alat asas ini mengendalikan tugas scraping yang paling biasa dengan cekap:
fetch_url
Alat paling mudah - mengambil HTML mentah daripada mana-mana URL dengan pengendalian ubah hala automatik.
curl -X POST https://crawlforge.dev/api/v1/tools/fetch_url \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{"url": "https://example.com"}'Sesuai untuk: muatan halaman awal, endpoint API, kandungan statik
extract_text
Membuang HTML dan memulangkan kandungan teks yang bersih dan mudah dibaca.
curl -X POST https://crawlforge.dev/api/v1/tools/extract_text \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{"url": "https://example.com/article"}'Sesuai untuk: analisis kandungan, konteks LLM, pemprosesan teks
extract_links
Menghurai semua tag anchor dan memulangkan data pautan berstruktur.
Sesuai untuk: pemetaan laman, benih crawler, analisis SEO
extract_metadata
Menarik metadata SEO, tag Open Graph, Twitter cards, dan data Schema.org.
Sesuai untuk: pratonton kandungan, audit SEO, analisis perkongsian sosial
Alat Pengekstrakan Berstruktur (2 Credits Setiap Satu)
Apabila anda memerlukan lebih daripada kandungan mentah:
scrape_structured
Gunakan pemilih CSS untuk mengekstrak elemen tertentu ke dalam JSON berstruktur.
{
"url": "https://store.example.com/products",
"selectors": {
"title": "h1.product-title",
"price": "span.price",
"rating": "div.rating-stars"
}
}Sesuai untuk: data e-dagang, penyenaraian, halaman berstruktur
extract_content
Pengekstrakan kandungan utama yang pintar - membuang navigasi, iklan, dan teks isian.
Sesuai untuk: artikel, pos blog, halaman dokumentasi
map_site
Menemui dan memetakan struktur laman web, mencari semua URL yang boleh diakses.
{
"url": "https://docs.example.com",
"maxDepth": 3,
"includePatterns": ["/docs/*"]
}Sesuai untuk: perancangan pra-crawl, pengindeksan dokumentasi, penjanaan sitemap
process_document
Mengekstrak teks daripada PDF dan format dokumen lain melalui URL.
Sesuai untuk: scraping PDF, pemprosesan dokumen, kertas akademik
localization
Scraping bersasar geografi dengan 26+ proxy negara, penyamaran zon waktu, dan pengepala tempatan.
{
"url": "https://store.example.com",
"country": "UK",
"language": "en-GB"
}Sesuai untuk: perbandingan harga, kandungan tempatan, laman terhad geografi
Alat Lanjutan (3-5 Credits)
Untuk senario scraping yang rumit:
analyze_content (3 Credits)
Analisis kandungan dikuasakan AI termasuk sentimen, pengesanan bahasa, dan pengekstrakan topik.
Sesuai untuk: analisis sentimen, pengelasan kandungan, pengesanan bahasa
stealth_mode (5 Credits)
Pelayaran anti-pengesanan dengan rawakan cap jari dan simulasi tingkah laku manusia -- teknik yang sama digunakan oleh Playwright di sebalik tabir, dengan tampalan stealth digunakan.
Sesuai untuk: laman dengan pengesanan bot, halaman dilindungi Cloudflare
summarize_content (4 Credits)
Ringkasan dijana AI dengan panjang dan fokus yang boleh dikonfigurasi.
Sesuai untuk: ringkasan kandungan, ringkasan penyelidikan, gambaran keseluruhan pantas
crawl_deep (4 Credits)
Crawling berbilang halaman dengan kawalan kedalaman, pemadanan corak, dan pengekstrakan kandungan. 4 credits tetap setiap panggilan tanpa mengira berapa banyak halaman di-crawl.
{
"url": "https://blog.example.com",
"maxDepth": 2,
"maxPages": 50,
"extractContent": true
}Sesuai untuk: arkib blog, laman dokumentasi, pengindeksan seluruh laman
scrape_with_actions (5 Credits)
Automasi pelayar dengan keupayaan klik, taip, skrol, dan tangkapan skrin.
{
"url": "https://app.example.com/login",
"actions": [
{"type": "type", "selector": "#email", "text": "user@example.com"},
{"type": "click", "selector": "button[type=submit]"},
{"type": "wait", "timeout": 3000}
]
}Sesuai untuk: kandungan berpagar log masuk, borang interaktif, navigasi SPA
batch_scrape (5 Credits)
Memproses pelbagai URL secara selari dengan format respons bersatu. 5 credits tetap setiap panggilan tanpa mengira bilangan URL.
{
"urls": [
"https://site1.com",
"https://site2.com",
"https://site3.com"
],
"maxConcurrency": 10
}Sesuai untuk: pengumpulan data pukal, scraping perbandingan, kecekapan
search_web (5 Credits)
Integrasi Google Custom Search untuk menemui URL yang berkaitan.
Sesuai untuk: titik permulaan penyelidikan, penemuan topik, analisis persaingan
track_changes (3 Credits)
Memantau laman web untuk perubahan kandungan dengan kepekaan yang boleh dikonfigurasi. 3 credits tetap setiap panggilan.
Sesuai untuk: pemantauan pesaing, penjejakan harga, makluman berita
Alat Penyelidikan AI (10 Credits)
deep_research
Alat paling berkuasa - penyelidikan berbilang peringkat dengan pengesahan dan sintesis sumber.
{
"topic": "Next.js 15 performance improvements",
"depth": "moderate",
"maxSources": 10
}Memulangkan:
- Ringkasan tersintesis
- Penemuan utama dengan skor keyakinan
- Sumber disahkan dengan kedudukan keberkaitan
- Pengesanan percanggahan antara sumber
Sesuai untuk: perisikan persaingan, penyelidikan pasaran, penyelidikan teknikal, semakan fakta
Petua Pengoptimuman Credit
- Mula murah: Gunakan
fetch_url(1 credit) sebelum mencuba alat yang mahal - Berkelompok apabila boleh:
batch_scrapelebih cekap daripada panggilan individu - Kenali URL anda: Jangan gunakan
search_web(5 credits) apabila anda sudah ada URL - Cache hasil: URL sama = kandungan sama, jangan scrape semula tanpa keperluan
- Gunakan alat yang betul:
extract_content(2 credits) mengatasi penghuraian manual
Perbandingan Harga
| Plan | Credits/Bulan | Harga | Kos per Credit |
|---|---|---|---|
| Free | 1,000 | $0 | - |
| Hobby | 5,000 | $19 | $0.0038 |
| Professional | 50,000 | $99 | $0.00198 |
| Business | 250,000 | $399 | $0.00160 |
Bermula
- Daftar secara percuma di crawlforge.dev/signup
- Dapatkan 1,000 credits serta-merta (tanpa kad kredit)
- Tambah ke Claude Desktop dalam 5 minit (panduan)
Bersedia untuk bermula? Cipta akaun percuma anda di crawlforge.dev dan buka kunci kesemua 26 alat hari ini.
Cuba sendiri — tiada pendaftaran diperlukan
Jalankan mana-mana daripada 27 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.
1,000 credits percuma • Isi semula setiap bulan • Tiada kad kredit diperlukan
Tag
Tentang Penulis
Kekal dikemas kini dengan pandangan terkini
Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.
Tiada spam. Berhenti melanggan bila-bila masa.