CrawlForge
Laman UtamaPlaygroundKes PenggunaanIntegrasiHargaDokumentasiBlog
CrawlForge v4.2.2: CLI Baharu + 3 Alat untuk Scraping AI Tempatan
Product Updates
Kembali ke Blog
Kemas Kini Produk

CrawlForge v4.2.2: CLI Baharu + 3 Alat untuk Scraping AI Tempatan

C
CrawlForge Team
Pasukan Kejuruteraan
18 Mei 2026
6 min bacaan

Pada halaman ini

Jawapan Pantas

CrawlForge v4.2.2 menghadirkan CLI tersendiri (digabungkan dalam pakej crawlforge-mcp-server) dan tiga alat baharu: extract_with_llm untuk pengekstrakan AI tempatan melalui Ollama, list_ollama_models untuk penemuan model, dan scrape_template untuk scraping satu baris bagi 10 tapak popular. CLI berjalan di mana sahaja npm berjalan dan tidak memerlukan klien MCP. Pasang dengan `npm install -g crawlforge-mcp-server`.

Hari ini kami menghadirkan CrawlForge v4.2.2, keluaran terbesar kami sejak pelancaran. Ia membawa tiga alat baharu, antara muka baris arahan tersendiri, dan satu peralihan senyap dalam cara kami memikirkan web scraping untuk AI: kebanyakannya sepatutnya berjalan secara tempatan, pada mesin anda sendiri, tanpa API keys.

Pos ini ialah payung untuk segala-galanya dalam 4.2.2. Tiga panduan mendalam menyusul dalam sembilan hari akan datang.

Jadual Kandungan

  • Apa yang Dihadirkan
  • CLI CrawlForge Baharu
  • Extract With LLM: Pengekstrakan AI Tempatan
  • Scrape Template: Sepuluh Tapak, Satu Panggilan
  • list_ollama_models: Penemuan Model
  • Aliran Kerja Lama vs Aliran Kerja v4.2.2
  • Kos Credit
  • Cara Menaik Taraf
  • Apa yang Seterusnya

Apa yang Dihadirkan

v4.2.2 menambah empat perkara:

  1. CLI crawlforge -- alat baris arahan tersendiri, dihadirkan dalam pakej crawlforge-mcp-server, yang mendedahkan kesemua 26 alat CrawlForge kepada shell anda. Tiada klien MCP diperlukan.
  2. extract_with_llm -- pengekstrakan berstruktur berkuasa LLM yang lalainya menggunakan Ollama tempatan. Tiada API key luaran diperlukan.
  3. scrape_template -- scraper pra-bina untuk Amazon, LinkedIn, GitHub, YouTube, Reddit, Hacker News, Stack Overflow, npm, Product Hunt, dan Twitter/X.
  4. list_ollama_models -- alat penemuan yang menyenaraikan model pada instans Ollama tempatan anda.

Bilangan alat meningkat daripada 20 ke 23. CLI ini baharu sama sekali -- ia bukan alat, ia ialah saluran penghantaran.

CLI CrawlForge Baharu

CLI ialah laluan terpendek daripada niat ke data yang di-scrape. Anda memasangnya sekali, menetapkan pemboleh ubah persekitaran, dan setiap alat CrawlForge menjadi satu arahan:

Bash
npm install -g crawlforge-mcp-server
export CRAWLFORGE_API_KEY="cf_live_your_key_here"

crawlforge scrape https://example.com
crawlforge search "best MCP servers 2026"
crawlforge research "AI agent frameworks" --depth deep

Mengapa ini penting? Kerana MCP hebat untuk ejen AI, tetapi banyak kerja scraping bukanlah tugas ejen AI. Ia ialah kerja cron. Langkah CI. Tarikan sekali sahaja daripada terminal anda. Untuk itu, anda mahukan JSON pada stdout yang menyalur masuk ke jq, bukan jabat tangan JSON-RPC.

Baca panduan lengkap CLI CrawlForge untuk rujukan arahan penuh dan aliran kerja dunia sebenar.

Extract With LLM: Pengekstrakan AI Tempatan

extract_with_llm ialah pengekstrakan berstruktur yang dikuasakan oleh model bahasa. Anda memberinya URL dan skema, ia mengembalikan JSON kepada anda. Bahagian baharunya ialah ia lalainya menggunakan Ollama tempatan dan bukannya memanggil OpenAI atau Anthropic.

Typescript
// Pull structured data with a local model. No API key needed.
{
  "url": "https://news.ycombinator.com/item?id=123456",
  "schema": {
    "type": "object",
    "properties": {
      "title": { "type": "string" },
      "points": { "type": "number" },
      "comments": { "type": "number" }
    }
  },
  "provider": "ollama",
  "model": "llama3.1:8b"
}

Tiga perkara berikutan lalai tempatan-dahulu:

  • Tiada kos API pihak ketiga. LLM adalah percuma. Anda hanya membayar 3 CrawlForge credits setiap pengekstrakan.
  • Tiada data meninggalkan mesin anda. Kandungan yang di-scrape kekal pada localhost.
  • Tiada API key baharu untuk diuruskan. Jika Ollama dipasang, anda sudah selesai.

OpenAI dan Anthropic masih disokong melalui provider: "openai" atau provider: "anthropic" untuk kes apabila anda mahukan model frontier. Panduan terperinci: ekstrak data dengan LLM tempatan.

Scrape Template: Sepuluh Tapak, Satu Panggilan

scrape_template adalah untuk ekor panjang permintaan scraping yang semuanya kelihatan sama: "dapatkan saya data produk daripada Amazon", "dapatkan saya metadata repo GitHub", "dapatkan saya pos teratas di Hacker News hari ini". Anda tidak sepatutnya perlu menulis pemilih CSS untuk ini. Kami melakukannya sekali, kami menyelenggaranya, anda memanggilnya.

Bash
crawlforge template amazon-product "https://www.amazon.com/dp/B0CHX1W1XY"
crawlforge template github-repo "https://github.com/anthropics/anthropic-sdk-python"
crawlforge template hacker-news-front-page "https://news.ycombinator.com"

Sepuluh templat dihadirkan dalam keluaran ini:

TemplatApa yang dikembalikanCredits
amazon-productTajuk produk, harga, penilaian, ulasan, imej1
linkedin-profileNama profil, tajuk, lokasi, tentang1
github-repoMetadata repo, bintang, bahasa, topik1
youtube-videoTajuk video, tontonan, saluran, perihalan1
reddit-threadTajuk pos, skor, pengarang, badan1
hacker-news-front-pageTajuk cerita halaman hadapan, mata, URL, komen1
stackoverflow-questionSoalan, jawapan, diterima, kiraan undi1
npm-packageMetadata pakej, muat turun mingguan, versi1
producthunt-launchNama produk, slogan, undi naik, topik1
tweetTeks tweet, pengarang, URL, imej1

Panduan lengkap dengan kod: scrape Amazon, LinkedIn, dan GitHub dengan satu alat.

list_ollama_models: Penemuan Model

Paling berguna sebagai pemeriksaan kewarasan sebelum menjalankan extract_with_llm. Menyenaraikan setiap model pada instans Ollama tempatan anda dengan nama, saiz, dan tarikh diubah suai.

Bash
crawlforge extract --list-ollama-models

Berharga 1 credit. Ia tidak melakukan scraping, tiada panggilan LLM -- ia hanya menanyakan API tempatan Ollama pada 127.0.0.1:11434 dan mengembalikan hasilnya. Jika anda pernah tertanya-tanya model manakah yang sebenarnya anda telah pasang, inilah jawapannya.

Aliran Kerja Lama vs Aliran Kerja v4.2.2

TugasPra-4.2.2v4.2.2
Scrape daripada terminal andacurl + penghurai tersuai, atau but Node REPLcrawlforge scrape <url>
Ekstrak data berstruktur dengan LLMextract_structured (pemilih CSS) atau bina sendiri dengan Puppeteer + OpenAIextract_with_llm (Ollama lalai)
Scrape Amazon, LinkedIn, GitHubscrape_structured dengan pemilih diselenggara secara manualscrape_template (kami menyelenggara pemilih)
Jalankan scraping dalam CI/croncurl dengan API key dalam pengepalacrawlforge <cmd> dengan pemboleh ubah env

Kos Credit

Tiga alat baharu mengikuti model kos credit sedia ada kami. Tiada kejutan:

AlatCreditsMengapa
list_ollama_models1Pembantu penemuan
scrape_template1Satu halaman, skema pra-bina
extract_with_llm3Inferens LLM (agnostik penyedia)

CLI itu sendiri adalah percuma. Ia menggunakan API key sedia ada anda dan dikira terhadap baki credit biasa anda.

Cara Menaik Taraf

Pengguna sedia ada tidak perlu melakukan apa-apa. Alat baharu telah aktif pada semua pelan -- Free, Hobby, Professional, dan Business -- dan muncul secara automatik dalam klien MCP anda.

Jika anda mahukan CLI:

Bash
npm install -g crawlforge-mcp-server
export CRAWLFORGE_API_KEY="cf_live_..."
crawlforge --help

Jika anda ingin mencuba pengekstrakan berkuasa Ollama:

Bash
# 1. Install Ollama (one-time)
curl -fsSL https://ollama.com/install.sh | sh

# 2. Pull a model (llama3.1:8b is a good start)
ollama pull llama3.1:8b

# 3. Run extraction through CrawlForge
crawlforge extract https://example.com --provider ollama --model llama3.1:8b

Apa yang Seterusnya

Kami sedang mengusahakan tiga perkara untuk 4.3:

  • Lebih banyak templat -- Etsy, eBay, TikTok, Instagram, Google Maps. Hantar permintaan kepada kami di Discord.
  • Penghantaran webhook untuk batch_scrape -- dapatkan hasil ditolak ke titik akhir anda apabila kerja jangka panjang selesai.
  • Mod tonton CLI -- crawlforge track --watch untuk diff langsung pada halaman yang dipantau.

Bersedia untuk mencuba alat baharu? Mulakan secara percuma dengan 1,000 credits -- tiada kad kredit diperlukan. Atau terus melompat ke panduan mendalam: panduan CLI, pengekstrakan LLM tempatan, dan sepuluh templat scrape.

Cuba sendiri — tiada pendaftaran diperlukan

Jalankan mana-mana daripada 27 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Isi semula setiap bulan • Tiada kad kredit diperlukan

Tag

releasev4.2.2CLIOllamaannouncementMCP

Tentang Penulis

C

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Praktikkan ini

Uji alat CrawlForge pada mana-mana URL — percuma, tanpa pendaftaran.

Pada halaman ini

Frequently Asked Questions

Apakah yang baharu dalam CrawlForge v4.2.2?+

v4.2.2 menambah tiga alat (extract_with_llm, list_ollama_models, scrape_template) dan CLI tersendiri yang dihadirkan di dalam pakej crawlforge-mcp-server sebagai arahan `crawlforge`. Bilangan alat meningkat daripada 20 ke 23. CLI ini baharu sama sekali dan berjalan tanpa klien MCP, jadi anda boleh menggunakan CrawlForge daripada mana-mana terminal, kerja cron, atau saluran paip CI.

Adakah saya memerlukan CLI CrawlForge jika saya sudah menggunakan MCP?+

Tidak. MCP masih paling sesuai untuk ejen AI (Claude, Cursor, Windsurf, dll.). CLI wujud untuk separuh lagi kerja scraping -- kerja cron, langkah CI, tarikan sekali sahaja daripada terminal anda -- di mana jabat tangan MCP adalah berlebihan dan anda hanya mahukan JSON pada stdout yang menyalur masuk ke jq.

Adakah extract_with_llm memerlukan API key OpenAI atau Anthropic?+

Tidak. Ia lalainya menggunakan Ollama tempatan, yang berjalan sepenuhnya pada mesin anda tanpa memerlukan API key luaran. OpenAI dan Anthropic disokong sebagai penyedia pilihan jika anda mahukan model frontier, tetapi laluan lalai adalah sepenuhnya tempatan.

Tapak manakah yang disokong oleh scrape_template?+

Sepuluh tapak dalam v4.2.2: Amazon, LinkedIn, GitHub, YouTube, Reddit, Hacker News, Stack Overflow, npm, Product Hunt, dan Twitter/X. Setiap satu berharga 1 credit setiap scrape dan mengembalikan JSON berstruktur khusus tapak tanpa memerlukan pemilih CSS.

Bagaimanakah cara saya menaik taraf ke v4.2.2?+

Pengguna sedia ada tidak perlu melakukan apa-apa -- alat baharu telah aktif pada semua pelan dan muncul secara automatik dalam klien MCP anda. Untuk memasang CLI baharu, jalankan "npm install -g crawlforge-mcp-server" dan tetapkan pemboleh ubah persekitaran CRAWLFORGE_API_KEY.

Artikel Berkaitan

CrawlForge v4.8.0: Claude Skills yang Aktif Secara Automatik
Product Updates

CrawlForge v4.8.0: Claude Skills yang Aktif Secara Automatik

CrawlForge MCP v4.8.0 menghadirkan 7 Claude Agent Skills yang aktif secara automatik untuk 26 alatnya, perlindungan SSRF yang dikuatkuasakan, screenshot yang berfungsi, format branding berasaskan design tokens, dan pemantauan perubahan berjadual terbina dalam.

C
CrawlForge Team
|
28 Jun
|
8m
CrawlForge MCP Kini Tersedia: Web Scraping Percuma untuk Agen AI
Product Updates

CrawlForge MCP Kini Tersedia: Web Scraping Percuma untuk Agen AI

CrawlForge MCP dilancarkan hari ini dengan 26 alat web scraping, integrasi MCP untuk Claude dan Cursor, serta free tier dengan 1,000 credits. Bina agen dengan lebih pantas.

C
CrawlForge Team
|
31 Mac
|
6m
18 Alat Web Scraping dalam Satu MCP Server: Panduan Lengkap CrawlForge
Product Updates

18 Alat Web Scraping dalam Satu MCP Server: Panduan Lengkap CrawlForge

Terokai kesemua 26 alat web scraping dalam CrawlForge MCP - daripada pengambilan URL asas hingga penyelidikan dikuasakan AI. Rujukan lengkap untuk pembangun ejen AI.

C
CrawlForge Team
|
7 Jan
|
10m

Footer

CrawlForge

Web scraping gred perusahaan untuk Ejen AI. 27 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.