CrawlForge
Laman UtamaPlaygroundKes PenggunaanIntegrasiHargaDokumentasiBlog
Cara Mengikis Tapak Web dalam Cursor IDE dengan CrawlForge MCP
Tutorials
Kembali ke Blog
Tutorial

Cara Mengikis Tapak Web dalam Cursor IDE dengan CrawlForge MCP

C
CrawlForge Team
Pasukan Kejuruteraan
14 April 2026
9 min bacaan

Pada halaman ini

Cursor IDE hebat dalam menaakul tentang kod anda tetapi tidak dapat melihat web secara langsung. Tambah CrawlForge melalui penyepaduan Model Context Protocol Cursor dan Composer mendapat 26 alat scraping -- tiada skrip Python, tiada curl, tiada meninggalkan editor.

Json
// ~/.cursor/mcp.json
{
  "mcpServers": {
    "crawlforge": {
      "command": "crawlforge-mcp-server",
      "env": { "CRAWLFORGE_API_KEY": "cf_live_your_key" }
    }
  }
}

Panduan ini menerangkan langkah demi langkah cara menyediakan web scraping dalam Cursor IDE, dengan contoh yang boleh dijalankan untuk penyelidikan, pengekstrakan berstruktur, dan pemantauan pesaing.

Isi Kandungan

  • Mengapa Mengikis dari Dalam Cursor?
  • Prasyarat
  • Langkah 1: Pasang MCP Server
  • Langkah 2: Konfigurasikan Tetapan MCP Cursor
  • Langkah 3: Mulakan Semula dan Sahkan
  • Langkah 4: Scrape Pertama Anda dalam Composer
  • Contoh Penuh: Bina Penjejak Harga Pesaing
  • Aliran Kerja: Gunakan Scrape untuk Menulis Kod
  • Penyelesaian Masalah
  • Soalan Lazim

Mengapa Mengikis dari Dalam Cursor?

Cursor Composer menganggap alat MCP sebagai tindakan kelas pertama: ia memilih alat yang betul untuk sesuatu tugasan, menghantar argumen bertaip, dan menyalurkan hasil kembali ke dalam perbualan. Apabila anda mengikis tapak web dalam Cursor IDE melalui CrawlForge, data yang diekstrak segera tersedia untuk Cursor menjana ujian, menulis antara muka TypeScript, atau mengemas kini papan pemuka. Tiada salin-tampal, tiada penukaran konteks.

Jika anda sudah menggunakan peraturan Cursor untuk membentuk tingkah laku Composer, alat MCP masuk dengan tepat -- peraturan menerangkan cara mengekod, alat mendedahkan apa yang Composer boleh lakukan.

Prasyarat

  • Cursor IDE 0.42+ -- muat turun dari cursor.com
  • Node.js 18+ -- node --version untuk menyemak
  • Akaun CrawlForge -- percuma di crawlforge.dev/signup

Langkah 1: Pasang MCP Server

Bash
npm install -g crawlforge-mcp-server

Sahkan ia berada pada PATH anda:

Bash
which crawlforge-mcp-server
# /usr/local/bin/crawlforge-mcp-server

Langkah 2: Konfigurasikan Tetapan MCP Cursor

Cursor membaca MCP server daripada ~/.cursor/mcp.json. Ciptanya jika ia belum wujud:

Bash
mkdir -p ~/.cursor
touch ~/.cursor/mcp.json

Tampal konfigurasi ini (gantikan kunci):

Json
{
  "mcpServers": {
    "crawlforge": {
      "command": "crawlforge-mcp-server",
      "env": {
        "CRAWLFORGE_API_KEY": "cf_live_your_key_here"
      }
    }
  }
}

Pada Windows fail itu terletak di %USERPROFILE%\.cursor\mcp.json dan arahannya patut menjadi crawlforge-mcp-server.cmd.

Langkah 3: Mulakan Semula dan Sahkan

  1. Keluar daripada Cursor sepenuhnya (Cmd+Q pada macOS).
  2. Buka semula projek.
  3. Pergi ke Settings -> Features -> MCP. Anda sepatutnya melihat crawlforge dengan titik hijau dan 26 alat disenaraikan.

Jika server berwarna merah atau senarai alat kosong, langkau ke Penyelesaian Masalah.

Langkah 4: Scrape Pertama Anda dalam Composer

Buka Composer (Cmd+I) dan tampal:

Use CrawlForge to fetch https://news.ycombinator.com and list the top 5 story titles.

Cursor akan memanggil fetch_url (1 credit) dan memaparkan respons. Apabila anda meluluskan panggilan alat itu, Composer menghuraikan HTML dan mengembalikan senarai yang bersih.

Contoh Penuh: Bina Penjejak Harga Pesaing

Katakan anda mahu menjejaki perubahan harga pada SaaS pesaing. Buka Composer dan tampal:

Use scrape_structured to pull pricing from https://competitor.example.com/pricing. Fields: plan (h3), price (.price), features (ul li). Then generate a TypeScript type for the response.

Cursor mengeluarkan panggilan scrape_structured dengan pemilih anda, mengembalikan JSON, dan menghasilkan TypeScript ini dalam ketulan editor seterusnya:

Typescript
// types/competitor-pricing.ts
export interface CompetitorPricingTier {
  plan: string;
  price: string;
  features: string[];
}

export interface CompetitorPricingResponse {
  data: CompetitorPricingTier[];
  scraped_at: string;
}

// lib/fetch-competitor-pricing.ts
import { CompetitorPricingResponse } from '@/types/competitor-pricing';

export async function fetchCompetitorPricing(): Promise<CompetitorPricingResponse> {
  const response = await fetch('https://crawlforge.dev/api/v1/tools/scrape_structured', {
    method: 'POST',
    headers: {
      'Authorization': `Bearer ${process.env.CRAWLFORGE_API_KEY}`,
      'Content-Type': 'application/json',
    },
    body: JSON.stringify({
      url: 'https://competitor.example.com/pricing',
      selectors: {
        plan: '.pricing-card h3',
        price: '.pricing-card .price',
        features: '.pricing-card ul li',
      },
    }),
  });

  if (!response.ok) {
    throw new Error(`Scrape failed: ${response.statusText}`);
  }

  return response.json();
}

Jumlah kos: 2 credits setiap larian. Jadualkannya melalui Vercel Cron atau GitHub Actions dan anda mempunyai penjejak harga peringkat percuma.

Aliran Kerja: Gunakan Scrape untuk Menulis Kod

Pembukaan kunci sebenar ialah menyalurkan data yang dikikis ke dalam penjanaan kod Cursor. Corak yang terbukti:

  • Penjanaan jenis daripada API langsung: "Fetch https://api.example.com/users, then generate a Zod schema matching the response."
  • Lekapan ujian daripada halaman sebenar: "Scrape the top 3 articles from Hacker News and save them as JSON fixtures in tests/fixtures/."
  • Pengekstrakan dokumentasi: "Use extract_content on the React docs for useState, then write an idiomatic example that matches."
  • Pariti ciri pesaing: "Use map_site on competitor.com and flag any URL patterns we do not have in our own sitemap."

Setiap corak ialah 1-5 credits setiap larian dan mengekalkan anda di dalam Cursor.

Ringkasan Kos Credit

OperasiAlatCredits
Ambil HTMLfetch_url1
Teks bersihextract_text1
Artikel boleh dibacaextract_content2
Pengekstrakan pemilih CSSscrape_structured2
Penemuan peta tapakmap_site2
Carian websearch_web5
SPA dengan klikscrape_with_actions5
Pintasan anti-botstealth_mode5

Penyelesaian Masalah

Senarai alat kosong dalam Cursor Settings -- Cursor menyimpan cache konfigurasi MCP. Keluar sepenuhnya (Cmd+Q), kemudian buka semula. Semak ~/.cursor/logs/ untuk ralat penghuraian.

"Command not found: crawlforge-mcp-server" -- bin global npm tiada pada PATH Cursor. Betulkan dengan menetapkan laluan mutlak dalam mcp.json: "command": "/usr/local/bin/crawlforge-mcp-server".

Setiap panggilan mengembalikan 401 -- kunci API hilang atau masih ruang letak. Sahkan dengan: curl -H "Authorization: Bearer $CRAWLFORGE_API_KEY" https://crawlforge.dev/api/v1/credits/balance.

Cursor meminta kelulusan pada setiap panggilan alat -- itu ialah tingkah laku lalai yang dijangka. Dayakan "Auto-approve for trusted servers" dalam tetapan MCP jika anda mahu Composer menjalankan scrape secara senyap.

Composer mengabaikan alat MCP -- Gesa secara eksplisit: "Use CrawlForge's scrape_structured tool to...". Cursor kadangkala memilih pengambilan web terbina dalamnya secara lalai, yang kurang berkeupayaan.

Langkah Seterusnya

  • Baca panduan peraturan Cursor untuk mengoptimumkan tingkah laku Composer bagi scraping
  • Layari gambaran keseluruhan 26 alat untuk melihat apa lagi yang anda boleh automasikan
  • Semak dokumen permulaan untuk rujukan API dan harga credit
  • Bandingkan vendor di alternatif Firecrawl

Mula percuma dengan 1,000 credits di crawlforge.dev/signup.

Cuba sendiri — tiada pendaftaran diperlukan

Jalankan mana-mana daripada 27 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Isi semula setiap bulan • Tiada kad kredit diperlukan

Tag

Cursor-IDEweb-scrapingMCPtutorialComposerdeveloper-toolsAI-agents

Tentang Penulis

C

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Praktikkan ini

Uji alat CrawlForge pada mana-mana URL — percuma, tanpa pendaftaran.

Pada halaman ini

Frequently Asked Questions

Di manakah Cursor IDE mencari konfigurasi MCP server?+

Cursor membaca konfigurasi MCP daripada ~/.cursor/mcp.json pada macOS dan Linux, dan %USERPROFILE%\\.cursor\\mcp.json pada Windows. Perubahan memerlukan permulaan semula penuh (Cmd+Q kemudian buka semula) untuk Cursor mengambilnya.

Bolehkah Cursor Composer menjalankan alat CrawlForge secara automatik?+

Ya. Dayakan auto-luluskan untuk server yang dipercayai dalam Settings > Features > MCP. Composer kemudian akan memanggil fetch_url, scrape_structured, dan alat CrawlForge lain tanpa dialog pengesahan setiap panggilan, yang sesuai untuk aliran kerja berulang.

Bagaimana ini berbeza daripada panduan Cursor Rules?+

Cursor Rules mengawal cara Composer menulis kod (gaya, rangka kerja, konvensyen fail). Alat MCP seperti CrawlForge menambah keupayaan baharu -- web scraping, pengekstrakan berstruktur, penyelidikan mendalam. Anda biasanya mahukan kedua-duanya: peraturan untuk membentuk output dan alat MCP untuk meluaskan apa yang Composer boleh lakukan.

Adakah Cursor menyokong alat MCP pada pelan percuma?+

Penyepaduan MCP berfungsi pada semua pelan Cursor, termasuk percuma. Anda hanya membayar untuk Cursor Pro jika anda memerlukan model lanjutan. CrawlForge juga mempunyai peringkat percuma (1,000 credits/bulan) jadi keseluruhan tindanan boleh berjalan pada kos sifar untuk penggunaan ringan.

Bolehkah saya menggunakan alat MCP Cursor dalam monorepo dengan berbilang projek?+

Ya -- konfigurasi MCP adalah global kepada profil pengguna anda, bukan setiap projek. Semua projek yang dibuka dalam Cursor mempunyai akses kepada alat CrawlForge yang sama. Untuk penggantian khusus projek, tambah .cursor/mcp.json di dalam akar repo dan Cursor mencantumkannya dengan konfigurasi global.

Artikel Berkaitan

Cara Scrape Tapak Web dengan Claude Code (Panduan 2026)
Tutorials

Cara Scrape Tapak Web dengan Claude Code (Panduan 2026)

Scrape mana-mana tapak web daripada terminal anda dengan Claude Code dan CrawlForge MCP. Fetch halaman, ekstrak data, pintas anti-bot -- dalam masa kurang daripada 2 minit.

C
CrawlForge Team
|
14 Apr
|
10m
Cara Melakukan Scraping Laman Web dalam Zed AI dengan CrawlForge MCP
Tutorials

Cara Melakukan Scraping Laman Web dalam Zed AI dengan CrawlForge MCP

Tambah web scraping ke Zed AI dalam 3 minit. Konfigurasikan CrawlForge MCP dalam Zed supaya editor anda boleh mengambil, mengekstrak, dan menyelidik data web langsung sesuka hati.

C
CrawlForge Team
|
14 Apr
|
9m
Cara Scrape Laman Web dengan Ejen GitHub Copilot dalam VS Code
Tutorials

Cara Scrape Laman Web dengan Ejen GitHub Copilot dalam VS Code

Tambah web scraping ke ejen GitHub Copilot dalam VS Code. Konfigurasikan CrawlForge MCP supaya Copilot boleh mengambil, mengekstrak, dan menyelidik data web langsung atas permintaan.

C
CrawlForge Team
|
14 Apr
|
10m

Footer

CrawlForge

Web scraping gred perusahaan untuk Ejen AI. 27 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.