CrawlForge
Laman UtamaPlaygroundKes PenggunaanIntegrasiHargaDokumentasiBlog
Web Scraping Daripada CLI: Panduan CrawlForge CLI
Tutorials
Kembali ke Blog
Tutorial

Web Scraping Daripada CLI: Panduan CrawlForge CLI

C
CrawlForge Team
Pasukan Kejuruteraan
21 Mei 2026
10 min bacaan

Pada halaman ini

Jawapan Pantas

CrawlForge CLI ialah pembungkus mengutamakan-terminal di sekeliling kesemua 26 tools CrawlForge. Ia dihantar di dalam pakej crawlforge-mcp-server sebagai arahan `crawlforge`, berfungsi tanpa klien MCP, mengeluarkan JSON untuk saluran paip shell, dan dipasang dalam 30 saat dengan `npm install -g crawlforge-mcp-server`. Gunakannya untuk kerja cron, langkah CI/CD, penyelidikan sekali sahaja, dan mana-mana aliran kerja yang anda mungkin akan menggunakan curl serta penghurai tersuai.

Kebanyakan alat AI gemar menjadi ejen. CrawlForge CLI dibina untuk yang sebaliknya: boleh diskrip, mengutamakan-terminal, boleh diramal. Anda memasangnya, menetapkan pemboleh ubah persekitaran, dan setiap satu daripada 26 tools CrawlForge menjadi arahan shell. JSON masuk, JSON keluar. Salurkan ke jq, jadualkan dengan cron, jalankan dalam CI -- ia berfungsi dengan cara yang sama di mana-mana.

Jadual Kandungan

  • Apakah Itu CrawlForge CLI?
  • Pasang dalam 30 Saat
  • 15 Arahan Sepintas Lalu
  • Scrape Pertama Anda
  • Menyalurkan Output JSON ke jq
  • Menjadualkan Dengan Cron
  • CLI vs MCP vs Raw API
  • Tiga Aliran Kerja Dunia Sebenar
  • Rujukan Bendera Global
  • Apa Kosnya

Apakah Itu CrawlForge CLI?

CrawlForge CLI dihantar di dalam pakej crawlforge-mcp-server sebagai arahan crawlforge dan mendedahkan kesemua 26 tools CrawlForge sebagai arahan terminal. Satu pemasangan global memberi anda kedua-dua MCP server dan CLI. Ia tidak memerlukan proses yang berjalan lama atau klien MCP: anda menaip crawlforge scrape <url>, ia membuat panggilan HTTPS ke API CrawlForge, dan mencetak JSON ke stdout. Itu sahaja keseluruhan ceritanya.

Ia wujud kerana separuh daripada kerja scraping yang dilakukan orang bukan berbentuk-ejen. Kerja cron, langkah CI, penyelidikan sekali sahaja, tarikan ad-hoc daripada shell -- itu memerlukan arahan biasa, bukan jabat tangan JSON-RPC.

Pasang dalam 30 Saat

Bash
npm install -g crawlforge-mcp-server
export CRAWLFORGE_API_KEY="cf_live_your_key_here"
crawlforge --help

Itu sahaja. Tiada fail konfigurasi, tiada aliran auth, tiada perkhidmatan untuk dimulakan. Jika anda belum mempunyai API key, dapatkan satu di crawlforge.dev/signup -- anda mendapat 1,000 credits percuma semasa pendaftaran.

Untuk menjadikan pemboleh ubah persekitaran kekal pada macOS atau Linux:

Bash
echo 'export CRAWLFORGE_API_KEY="cf_live_..."' >> ~/.zshrc
source ~/.zshrc

Pada Windows (PowerShell):

Powershell
[Environment]::SetEnvironmentVariable("CRAWLFORGE_API_KEY", "cf_live_...", "User")

15 Arahan Sepintas Lalu

Setiap arahan dipetakan ke satu atau lebih tools CrawlForge:

ArahanTool utamaCreditsContoh
scrapefetch_url, extract_content1-2crawlforge scrape https://example.com
searchsearch_web5crawlforge search "MCP servers 2026"
crawlcrawl_deep4crawlforge crawl https://docs.example.com --depth 3
mapmap_site2crawlforge map https://example.com
extractextract_with_llm3crawlforge extract <url> --schema schema.json
tracktrack_changes3crawlforge track <url> --threshold 10
analyzeanalyze_content3crawlforge analyze <url>
researchdeep_research10crawlforge research "AI agents in 2026"
stealthstealth_mode5crawlforge stealth <url>
batchbatch_scrape5crawlforge batch urls.txt
actionsscrape_with_actions5crawlforge actions <url> --script steps.json
localizelocalization2crawlforge localize <url> --country DE
llmstxtgenerate_llms_txt5crawlforge llmstxt https://example.com
templatescrape_template1crawlforge template amazon-product <url>
monitortrack_changes3crawlforge monitor <url> --interval 3600

Scrape Pertama Anda

Panggilan paling mudah yang mungkin:

Bash
crawlforge scrape https://news.ycombinator.com

Apa yang dipulangkan ialah kandungan utama halaman sebagai JSON:

Json
{
  "url": "https://news.ycombinator.com",
  "title": "Hacker News",
  "content": "Hacker News new | past | comments | ask...",
  "links": ["https://news.ycombinator.com/from?site=...", "..."],
  "fetched_at": "2026-05-21T10:14:33Z",
  "credits_used": 1
}

Mahukan URL sahaja? Salurkan ke jq:

Bash
crawlforge scrape https://news.ycombinator.com --json | jq '.links[]'

Mahukannya dalam fail? Ubah hala stdout:

Bash
crawlforge scrape https://news.ycombinator.com --pretty > hn.json

Menyalurkan Output JSON ke jq

Inilah aliran kerja yang menjadikan CLI berbaloi dipasang. Semuanya mengeluarkan JSON, dan JSON disalurkan ke apa sahaja.

Dapatkan tajuk cerita halaman hadapan HN:

Bash
crawlforge template hacker-news-front-page https://news.ycombinator.com --json \
  | jq -r '.stories[] | .title'

Cari di web dan ekstrak URL:

Bash
crawlforge search "best web scraping libraries 2026" --json \
  | jq '.results[] | .url'

Scrape halaman dan kira perkataan:

Bash
crawlforge scrape https://example.com --json \
  | jq -r '.content' \
  | wc -w

Batch scrape, kemudian tapis untuk respons ralat:

Bash
crawlforge batch urls.txt --json \
  | jq '.results[] | select(.status_code >= 400)'

Coraknya: --json memberi anda output yang boleh dibaca mesin, kemudian jq menghiris dan memotongnya.

Menjadualkan Dengan Cron

Semakan harian pada halaman harga pesaing:

Bash
# crontab -e
0 9 * * * /usr/local/bin/crawlforge track https://competitor.com/pricing --json > /var/log/pricing.json

Larian penyelidikan setiap malam:

Bash
0 2 * * * /usr/local/bin/crawlforge research "AI tooling news" --depth standard --pretty > /var/log/research.json

Penjanaan semula llms.txt mingguan untuk laman anda sendiri:

Bash
0 3 * * 0 /usr/local/bin/crawlforge llmstxt https://yoursite.com --include-full > /var/www/yoursite.com/llms.txt

Dalam CI? Gunakan arahan yang sama dalam YAML GitHub Actions anda. CLI menyemak CRAWLFORGE_API_KEY dahulu, jadi cuma tetapkannya sebagai rahsia repositori.

Yaml
# .github/workflows/daily-research.yml
- name: Run weekly research
  env:
    CRAWLFORGE_API_KEY: ${{ secrets.CRAWLFORGE_API_KEY }}
  run: |
    npm install -g crawlforge-mcp-server
    crawlforge research "industry news" --depth standard --pretty > report.json

CLI vs MCP vs Raw API: Bila Hendak Menggunakan Setiap Satu

Aliran kerjaGuna CLIGuna MCPGuna Raw API
Scrape sekali sahaja daripada terminal andayatidaktidak
Kerja cron atau langkah CIyatidakhanya jika perlu
Ejen Claude / Cursor / Windsurftidakyatidak
Tertanam dalam perkhidmatan Node/Pythontidakhanya jika berbentuk-MCPya
Pekerja latar belakang yang berjalan lamatidaktidakya
Penerokaan pantas laman yang tidak biasayamungkintidak

Petua umum: jika manusia menaip arahan, gunakan CLI. Jika LLM memilih tool, gunakan MCP. Jika server memanggilnya dalam gelung, gunakan raw API.

Tiga Aliran Kerja Dunia Sebenar

1. Pemantau Harga Kompetitif

Skrip shell yang berjalan setiap hari, melakukan scraping pada tiga halaman harga pesaing, membandingkan dengan petikan semalam, dan menyiarkan ke Slack jika ada apa-apa yang berubah.

Bash
#!/bin/bash
for url in $(cat competitors.txt); do
  crawlforge track "$url" --json \
    > "snapshots/$(date +%F)-$(basename $url).json"
done

# Diff against yesterday's snapshot
diff "snapshots/$(date -v-1d +%F)-pricing.json" \
     "snapshots/$(date +%F)-pricing.json" \
  || curl -X POST $SLACK_WEBHOOK -d '{"text": "Pricing changed"}'

Kos: ~9 credits sehari (3 pesaing × 3 credits untuk track).

2. Pengayaan Petunjuk Daripada CSV

Baca CSV domain syarikat, lakukan scraping pada setiap halaman utama untuk maklumat hubungan, tulis semula data yang diperkaya.

Bash
while IFS=, read -r company domain; do
  data=$(crawlforge scrape "https://$domain" --json)
  email=$(echo "$data" | jq -r '.metadata.contact_email // empty')
  echo "$company,$domain,$email" >> enriched.csv
done < companies.csv

Kos: 1 credit setiap syarikat.

3. Saluran Paip Laporan Penyelidikan

Cron Ahad mingguan yang menjalankan pertanyaan research dan menghantar e-mel ringkasan yang disintesis kepada pasukan.

Bash
crawlforge research "AI agent frameworks news this week" --depth deep --pretty > report.json
jq -r '.summary' report.json \
  | mail -s "Weekly AI report" team@example.com

Kos: 10 credits setiap larian (research termasuk ringkasan yang disintesis).

Rujukan Bendera Global

Ini berfungsi pada setiap arahan:

  • --json -- JSON padat yang boleh dibaca mesin (mesra-penyaluran)
  • --pretty -- JSON yang dicetak kemas
  • --quiet -- nyahkan semua output stdout (kod keluar sahaja)
  • --api-key <key> -- atasi pemboleh ubah persekitaran CRAWLFORGE_API_KEY
  • --timeout <ms> -- atasi tamat masa lalai 30s

Untuk menulis hasil ke fail, ubah hala stdout: crawlforge scrape <url> --pretty > out.json.

Apa Kosnya

CLI itu sendiri adalah percuma. Anda hanya membayar untuk panggilan tool yang mendasarinya, dikenakan terhadap baki credit sedia ada anda. Tiada langganan tambahan, tiada yuran setiap permulaan. Cron harian yang menjalankan track terhadap tiga URL dan research sekali seminggu kira-kira berharga 100 credits sebulan -- masih dalam free tier.


Bersedia untuk memasang? Dapatkan API key percuma anda di crawlforge.dev/signup dan jalankan npm install -g crawlforge-mcp-server. Baru di sini? Baca pengumuman pelancaran v4.2.2 untuk semua yang baharu, atau mula pantas MCP asal untuk versi MCP sebaliknya.

Cuba sendiri — tiada pendaftaran diperlukan

Jalankan mana-mana daripada 27 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Isi semula setiap bulan • Tiada kad kredit diperlukan

Tag

CLIweb-scrapingtutorialterminalautomationscripting

Tentang Penulis

C

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Praktikkan ini

Uji alat CrawlForge pada mana-mana URL — percuma, tanpa pendaftaran.

Pada halaman ini

Frequently Asked Questions

Adakah CrawlForge CLI percuma?+

Pakej CLI itu sendiri adalah percuma dan terbuka. Anda hanya membayar untuk panggilan tool yang mendasarinya yang dikenakan terhadap baki credit CrawlForge biasa anda, sama seperti yang anda lakukan daripada MCP atau raw API. Tiada yuran tambahan setiap permulaan.

Adakah saya memerlukan API key CrawlForge untuk menggunakan CLI?+

Ya. CLI membaca pemboleh ubah persekitaran CRAWLFORGE_API_KEY pada setiap panggilan. Dapatkan key percuma di crawlforge.dev/signup (tiada kad kredit diperlukan) dan tetapkannya sekali dalam profil shell anda.

Bolehkah saya menggunakan CrawlForge CLI dalam saluran paip CI/CD?+

Ya -- ini ialah salah satu kes penggunaan utamanya. Pasang melalui "npm install -g crawlforge-mcp-server" dalam pelari CI anda, tetapkan CRAWLFORGE_API_KEY sebagai rahsia repositori, dan jalankan sebarang arahan. Ia berfungsi dengan cara yang sama dalam GitHub Actions, GitLab CI, CircleCI, dan Jenkins.

Bagaimanakah CrawlForge CLI berbeza daripada curl?+

curl memberi anda HTML mentah. CrawlForge CLI memulangkan JSON berstruktur: kandungan yang dibersihkan, metadata yang diekstrak, pautan, tajuk, dan medan khusus tool seperti hasil carian, ringkasan penyelidikan, atau data produk yang di-scrape templat. Ia juga mengendalikan pertahanan anti-bot, stealth mode, dan automasi pelayar -- semua perkara yang curl tidak boleh lakukan.

Adakah CLI menyokong kesemua 26 tools CrawlForge?+

Ya. 15 arahan tersebut meliputi kesemua 26 tools (sesetengah arahan mendedahkan pelbagai tools melalui bendera). Sebagai contoh, "crawlforge extract" dipetakan ke extract_with_llm secara lalai dan extract_structured dengan bendera --css.

Bolehkah CrawlForge CLI mengeluarkan data berstruktur untuk dihurai?+

Ya -- hantar --json pada mana-mana arahan dan outputnya ialah JSON bersih yang sesuai untuk disalurkan ke dalam jq atau mana-mana tool yang sedar-JSON. Gunakan --pretty untuk pemformatan yang boleh dibaca manusia, atau ubah hala stdout ke fail (crawlforge scrape <url> --pretty > out.json).

Artikel Berkaitan

Cara Menggunakan CrawlForge dengan Make dan Zapier
Tutorials

Cara Menggunakan CrawlForge dengan Make dan Zapier

Sambungkan CrawlForge ke Make (Integromat) dan Zapier untuk web scraping automatik. Persediaan tanpa kod dengan modul HTTP, webhook, dan contoh aliran kerja.

C
CrawlForge Team
|
23 Apr
|
8m
Cara Scrape Tapak Web dengan Claude Code (Panduan 2026)
Tutorials

Cara Scrape Tapak Web dengan Claude Code (Panduan 2026)

Scrape mana-mana tapak web daripada terminal anda dengan Claude Code dan CrawlForge MCP. Fetch halaman, ekstrak data, pintas anti-bot -- dalam masa kurang daripada 2 minit.

C
CrawlForge Team
|
14 Apr
|
10m
Cara Membina MCP Server Web-Scraping dalam TypeScript (2026)
Tutorials

Cara Membina MCP Server Web-Scraping dalam TypeScript (2026)

Bina MCP server web-scraping yang berfungsi dalam TypeScript dengan SDK rasmi: sebuah server minimum, tool scraping cheerio sebenar, ujian, dan persediaan Claude Desktop.

C
CrawlForge Team
|
16 Jun
|
12m

Footer

CrawlForge

Web scraping gred perusahaan untuk Ejen AI. 27 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.