CrawlForge MCP
Laman UtamaPlaygroundKes PenggunaanIntegrasiHargaDokumentasiBlog
MCP server carian web self-hosted
AI Engineering
Kembali ke Blog
Kejuruteraan AI

MCP server carian web self-hosted

C
CrawlForge Team
Pasukan Kejuruteraan
28 Ogos 2026
4 min bacaan

Pada halaman ini

Jawapan Pantas

CrawlForge ialah MCP server carian web yang boleh di-self-host pada dua daripada tiga lapisan yang penting. Proses pelayannya ialah pakej npm berlesen MIT yang berjalan secara setempat melalui stdio, dan backend cariannya boleh menjadi instance SearXNG anda sendiri: tetapkan CRAWLFORGE_SEARXNG_URL dan hantar provider: "searxng" kepada search_web, maka pertanyaan anda tidak pernah keluar dari rangkaian anda. Tools berasaskan LLM pula menggunakan model Ollama setempat secara lalai. Apa yang bukan self-hosted ialah pengiraan penggunaan — setiap panggilan masih memerlukan API key CrawlForge dan search_web masih berharga 5 credits, tidak kira provider mana yang menjawabnya. Jika anda perlukan sifar kebergantungan kepada vendor, wrapper MCP yang asli untuk SearXNG lebih sesuai.

Cari MCP server carian web yang self-hosted dan hasilnya terbahagi kepada dua kumpulan: projek GitHub yang anda jalankan sepenuhnya sendiri, dan halaman vendor yang memanggil API terhos sebagai "setempat" semata-mata kerana kliennya berjalan pada komputer riba anda. Kedua-duanya perkara berbeza, dan yang mana satu anda perlukan bergantung pada apa yang sebenarnya ingin anda simpan sendiri.

Catatan ini khusus tentang di mana kedudukan CrawlForge pada garis itu — termasuk bahagian yang bukan self-hosted.

Apa maksud "self-hosted" bagi sebuah MCP server

Susunan carian web dengan MCP mempunyai tiga lapisan, dan setiap satunya boleh dihoskan secara berasingan:

  1. Proses pelayan — benda yang dilancarkan oleh klien MCP anda dan dihubungi melalui stdio.
  2. Backend carian — yang benar-benar menjawab pertanyaan itu.
  3. Satah kawalan — pengesahan, pengiraan penggunaan, pengebilan.

Kebanyakan dakwaan "self-hosted" hanya merangkumi lapisan 1. Menjalankan satu proses secara setempat itu perkara asas; hampir setiap MCP server melakukannya. Soalan yang menentukan sama ada ia dikira self-hosted dari sudut privasi ialah lapisan 2: adakah pertanyaan anda keluar dari rangkaian anda, dan siapa yang melihatnya?

Berapa banyak CrawlForge yang berjalan pada mesin anda

Lapisan 1 sepenuhnya milik anda. crawlforge-mcp-server ialah pakej npm berlesen MIT yang berjalan sebagai proses setempat melalui stdio — tiada daemon vendor, tiada runtime awan, dan kodnya ada di GitHub jika anda mahu membacanya sebelum menjalankannya.

Bash
npm install -g crawlforge-mcp-server

Lapisan 2 yang lebih menarik. search_web menerima parameter provider dengan dua nilai yang diterima, dan salah satunya ialah instance SearXNG anda sendiri:

Bash
export CRAWLFORGE_SEARXNG_URL=http://localhost:8888
Json
{
  "query": "mcp server directory",
  "provider": "searxng",
  "limit": 10
}

Dengan tetapan itu, pertanyaan pergi ke mesin SearXNG anda dan tidak ke mana-mana lagi — tiada vendor carian pihak ketiga yang melihat teks pertanyaan itu. Hasilnya dikembalikan dalam bentuk yang sama seperti provider terhos, jadi penyusunan, penyingkiran pendua dan cache masih berfungsi dan tiada apa-apa berubah di bahagian hiliran aliran kerja anda.

Tools berasaskan LLM mengikut corak yang sama. extract_with_llm, summarize_content dan analyze_content menggunakan model Ollama setempat secara lalai, jadi langkah pengekstrakan juga boleh kekal pada perkakasan anda.

Apa yang bukan self-hosted

Lapisan 3. Pengiraan penggunaan tetap melalui CrawlForge tidak kira provider mana yang anda pilih.

search_web dibalut dengan pemeriksaan pengesahan dan credits yang sama seperti setiap tool lain, dan pemeriksaan itu tidak tahu — dan tidak peduli — bahawa anda memilih SearXNG. Carian yang dilayan oleh SearXNG masih memerlukan API key yang sah dan masih berharga 5 credits, sama seperti carian terhos.

Eloklah dinyatakan dengan jelas apa yang anda dapat dan tidak dapat daripadanya. Menghoskan sendiri backend carian mengubah siapa yang melihat pertanyaan anda — satu keuntungan privasi yang nyata, dan itulah sebab biasa orang mahukannya. Ia tidak menjadikan tool ini percuma, dan ia tidak menghapuskan kebergantungan kepada vendor. Jika syarat anda ialah "tiada sambungan keluar kepada mana-mana vendor", CrawlForge tidak memenuhinya buat masa ini.

Bila pelayan yang sepenuhnya self-hosted itu pilihan yang betul

Jika lapisan 3 ialah bahagian yang anda perlu miliki — rangkaian terasing, tiada akaun vendor, tiada kos setiap panggilan — gunakan projek yang sepenuhnya self-hosted. SearXNG mempunyai wrapper MCP yang bercakap terus dengannya, dan untuk keperluan itu ia lebih sesuai daripada memintas-mintas sebuah tool yang dikira penggunaannya.

CrawlForge berbaloi apabila anda mahu backend carian kekal setempat tetapi masih mahu satu pelayan meliputi kerja yang selebihnya: scrape, extract_content, crawl_deep, serp_rank dan 23 tools lagi atas sambungan yang sama dan key yang sama. Mencari melalui instance anda sendiri dan mengekstrak dengan Ollama anda sendiri, sementara laluan terhos menguruskan halaman yang hanya ditunjukkan oleh SearXNG, ialah jalan tengah yang munasabah — dan pada praktiknya itulah konfigurasi yang akhirnya dikehendaki oleh kebanyakan orang yang mencari perkara ini.

Dapatkan API key — 1,000 credits sekali sahaja, tanpa kad. Tetapkan CRAWLFORGE_SEARXNG_URL, hantar provider: "searxng", dan pertanyaan anda kekal dalam rangkaian anda.

Cuba sendiri — tiada pendaftaran diperlukan

Jalankan mana-mana daripada 29 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Sekali sahaja • Tiada kad kredit diperlukan

Tag

mcpweb searchself-hostedsearxngsearch_webprivacy

Tentang Penulis

C

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Praktikkan ini

Uji alat CrawlForge pada mana-mana URL — percuma, tanpa pendaftaran.

Pada halaman ini

Frequently Asked Questions

Bolehkah anda self-host sebuah MCP server carian web dengan CrawlForge?+

Sebahagiannya boleh, dan perbezaan ini penting. Proses pelayannya self-hosted sepenuhnya: crawlforge-mcp-server ialah pakej npm berlesen MIT yang berjalan secara setempat melalui stdio tanpa sebarang daemon vendor. Backend cariannya juga boleh di-self-host — tetapkan CRAWLFORGE_SEARXNG_URL kepada instance SearXNG anda sendiri dan hantar provider: "searxng" kepada search_web, maka pertanyaan itu tidak pernah keluar dari rangkaian anda. Yang bukan self-hosted ialah pengiraan penggunaan: setiap panggilan masih disahkan terhadap CrawlForge dan membelanjakan credits.

Adakah carian melalui instance SearXNG saya sendiri masih menggunakan credits?+

Ya. search_web berharga 5 credits setiap panggilan, tidak kira provider mana yang menjawabnya. Pemeriksaan credits membalut tool itu dan berjalan sebelum provider dipilih, jadi ia tidak tahu bahawa SearXNG yang memberikan hasilnya. Menghoskan sendiri backend carian ialah perubahan privasi — pertanyaan anda kekal dalam rangkaian anda — bukan perubahan kos.

Apa bezanya MCP server setempat dengan backend carian yang self-hosted?+

MCP server setempat hanya bermaksud prosesnya berjalan pada mesin anda, yang benar bagi hampir setiap MCP server dan langsung tidak memberitahu ke mana pertanyaan itu pergi. Backend carian yang self-hosted bermaksud carian itu sendiri dijawab oleh infrastruktur yang anda jalankan — contohnya instance SearXNG anda sendiri — jadi teks pertanyaan tidak pernah dihantar kepada vendor carian pihak ketiga. Hanya yang kedua itu melindungi privasi pertanyaan anda.

Bolehkah tools berasaskan LLM berjalan secara setempat juga?+

Boleh. extract_with_llm, summarize_content dan analyze_content menggunakan model Ollama setempat secara lalai, jadi pengekstrakan dan peringkasan kandungan boleh berjalan pada perkakasan anda sendiri. Digabungkan dengan backend SearXNG yang self-hosted, itu mengekalkan kedua-dua pertanyaan carian dan kandungan halaman yang diekstrak dalam infrastruktur anda.

Artikel Berkaitan

Ekstrak Data Web Dengan LLM Setempat (Ollama + CrawlForge)
AI Engineering

Ekstrak Data Web Dengan LLM Setempat (Ollama + CrawlForge)

Tiada kunci API, tiada awan, tiada data meninggalkan mesin anda. Gunakan extract_with_llm dengan Ollama setempat untuk menarik data berstruktur daripada mana-mana tapak.

C
CrawlForge Team
|
24 Mei
|
9m
MCP Protocol Dijelaskan: Panduan Pembangun untuk 2026
AI Engineering

MCP Protocol Dijelaskan: Panduan Pembangun untuk 2026

Ketahui cara Model Context Protocol berfungsi, mengapa ia penting untuk ejen AI, dan cara membina MCP server serta klien dengan rajah seni bina dan kod.

C
CrawlForge Team
|
27 Apr
|
10m
AI Crawler List 2026: Every Bot + Should You Block Them?
AI Engineering

AI Crawler List 2026: Every Bot + Should You Block Them?

Every AI crawler that matters in 2026: 31 bots, their robots.txt tokens, and what blocking each one actually costs you. Copy-paste file included.

C
CrawlForge Team
|
25 Ogo
|
12m

Footer

CrawlForge MCP

Web scraping gred perusahaan untuk Ejen AI. 29 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.