CrawlForge MCP
Alat Lanjutan4 credits

summarize_content

Peringkasan ekstraktif: ayat diambil daripada sumber, tidak pernah ditulis semula. Alat ini memecahkan teks kepada ayat, membuang serpihan yang lebih pendek daripada 20 aksara, dan mengembalikan ayat-ayat awal dalam bentuk yang anda minta. Tiada model dipanggil, jadi halaman yang sama sentiasa diringkaskan dengan cara yang sama — dan tiada apa yang boleh direka.

Kes Penggunaan

Pratonton Suapan

Jana penggoda satu baris bagi setiap item dalam suapan pautan dengan summary_type: brief.

E-mel Ringkasan

Tukarkan senarai artikel kepada butiran bulet yang sedia untuk ditampal ke dalam surat berita.

Triaj Sebelum Membaca

Tentukan sama ada halaman yang panjang berbaloi untuk pengekstrakan penuh dengan melihat beberapa ayat pertamanya.

Cebisan Hasil Carian

Lampirkan cebisan yang konsisten dan boleh dipetik pada halaman terindeks, diambil kata demi kata daripada sumber.

Konteks Boleh Dipetik

Kerana ayat disalin dan bukannya diparafrasa, output boleh dipetik terus dan dirujuk.

Pra-Ringkasan Yang Murah

Kecilkan halaman sebelum menghantarnya kepada model bahasa, supaya model membayar lebih sedikit token.

Endpoint

POST/api/v1/tools/summarize_content
Auth Required
1 req/s pada pelan Free
4 credits

Parameters

Ini ialah peringkas ayat pembuka, bukan yang berperingkat: ia mengembalikan ayat-ayat pembuka teks, mengikut urutan. Ia berkesan pada berita dan prosa blog, yang meletakkan intipati di hadapan, dan lemah pada halaman yang menyembunyikan kesimpulan di hujung.
NameTypeRequiredDefaultDescription
url
stringOptional-
Halaman yang akan diambil dan diringkaskan. Script, style, nav, header dan footer dibuang terlebih dahulu. Berikan sama ada `url` atau `content`.
Example: https://example.com/blog/crawl-budgets
content
stringOptional-
Teks untuk diringkaskan terus, tanpa pengambilan. Hanya berkesan apabila `url` ditinggalkan — jika kedua-duanya dihantar, halaman yang diambil yang menang.
Example: Search engines allocate a finite number of requests...
max_sentences
numberOptional5
Berapa banyak ayat untuk dikekalkan, 1 hingga 20. Diabaikan apabila `summary_type` ialah `brief`, yang sentiasa mengembalikan satu.
Example: 3
summary_type
stringOptionalextractive
`extractive` mencantumkan ayat menjadi satu rentetan perenggan. `key_points` mengembalikannya sebagai tatasusunan rentetan, satu bagi setiap ayat. `brief` mengembalikan ayat pertama sahaja, sebagai rentetan.
Example: key_points
include_metadata
booleanOptionalfalse
Tambah tajuk, penerangan, pengarang dan tarikh terbit halaman sebagai objek `metadata`. Hanya berkesan bersama `url` — tiada metadata untuk dibaca apabila anda menghantar `content`.
Example: true
timeout
numberOptional10000
Had masa pengambilan dalam milisaat, antara 1000 dan 30000. Hanya terpakai apabila `url` digunakan.
Example: 10000
respect_robots
booleanOptionaltrue
Hormati robots.txt tapak sasaran. Dibiarkan pada `true`, laluan yang dilarang untuk `CrawlForge` ditolak dengan 403 sebelum apa-apa diambil dan tiada credits dicaj. Tetapkan kepada `false` hanya untuk sasaran yang anda mempunyai perjanjian sendiri dengannya — respons kemudiannya membawa entri `warnings` dan tindakan mengatasi itu direkodkan pada API key anda.
Example: true

Contoh Permintaan

terminalBash
curl -X POST https://crawlforge.dev/api/v1/tools/summarize_content \
  -H "X-API-Key: cf_test_YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "url": "https://example.com/blog/crawl-budgets",
    "max_sentences": 3,
    "summary_type": "extractive",
    "include_metadata": true
  }'

Contoh Respons

200 OK540ms
{
"success": true,
"data": {
"summary": "Search engines allocate a finite number of requests to each site, and that allowance is what people mean by crawl budget. Large sites hit the ceiling long before small ones do, usually through duplicate URLs rather than genuine pages. Faceted navigation is the classic offender, generating thousands of near-identical addresses from a single catalogue.",
"summary_type": "extractive",
"original_length": 613,
"summary_length": 352,
"compression_ratio": 0.57,
"sentences_used": 3,
"total_sentences": 5,
"metadata": {
"title": "Why crawl budgets matter — Acme Blog",
"description": "How search engines ration requests, and what to do about it.",
"author": "Dana Reyes",
"publish_date": "2026-08-14T09:30:00Z"
}
},
"credits_used": 4,
"credits_remaining": 996,
"processing_time": 540
}
Field Descriptions
data.summaryRentetan untuk `extractive` dan `brief`, tatasusunan rentetan untuk `key_points`. Taipkan klien anda dengan sewajarnya
data.original_lengthAksara teks sumber selepas HTML dibuang, bukan saiz mentah halaman
data.compression_ratio`summary_length / original_length`, dibundarkan kepada dua perpuluhan. Lebih rendah bermakna ringkasan lebih padat
data.sentences_usedAyat yang benar-benar dikembalikan — lebih rendah daripada `max_sentences` pada halaman yang pendek
data.total_sentencesAyat yang ditemui dalam sumber, mengira hanya yang melebihi 20 aksara. Bandingkan dengan `sentences_used` untuk melihat berapa banyak yang ditinggalkan
data.metadataHadir hanya apabila `include_metadata` ialah true dan `url` diberikan. Medan individu tidak ditakrifkan apabila halaman tidak mengisytiharkannya
credits_used4 credits tetap setiap panggilan, tidak kira panjang teks

Pengendalian Ralat

Tiada url mahupun content (400 Bad Request)

VALIDATION_ERROR. Sekurang-kurangnya satu daripada dua itu mesti ada. Status yang sama meliputi url yang cacat, max_sentences di luar 1-20, summary_type yang tidak dikenali, atau timeout di luar 1000-30000.

Halaman Terlalu Besar (413 Payload Too Large)

RESPONSE_TOO_LARGE. Halaman yang diambil melebihi had bacaan 25MB dan ditolak dan bukannya ditimbal.

Sasaran Tamat Masa (504 Gateway Timeout)

FETCH_TIMEOUT. Halaman berhenti bertindak balas semasa menghantar badannya. Naikkan timeout, sehingga 30000ms.

Pengambilan Gagal (502 Bad Gateway)

FETCH_FAILED. Badan respons tidak dapat dibaca — sambungan ditetapkan semula, atau badan yang bukan teks boleh nyahkod.

Peringkasan Gagal (500 Internal Server Error)

TOOL_ERROR. Panggilan yang gagal tidak dicaj; credits hanya ditolak selepas ringkasan dihasilkan.

Disekat oleh robots.txt (403 Forbidden)

robots.txt tapak sasaran melarang laluan ini untuk CrawlForge. Tetapkan respect_robots: false untuk mengatasinya jika anda mempunyai perjanjian sendiri dengan sasaran — tindakan mengatasi itu direkodkan pada API key anda. Tindakan mengatasi itu tidak sampai kepada hos yang berada dalam senarai penarikan diri kekal CrawlForge, yang ditolak tanpa mengira nilai respect_robots. Hanya bentuk url yang disemak — meringkaskan content yang anda berikan tidak mengambil apa-apa, jadi ia tidak boleh ditolak di sini.

Nota: Teks tanpa ayat melebihi 20 aksara menghasilkan No content to summarize di bawah brief, dan hasil kosong di bawah jenis yang lain, bukannya ralat. Periksa total_sentences sebelum menggunakan ringkasan itu.

Kos Credit

4 credits
4 credits setiap panggilan
Kadar rata sama ada anda menghantar URL atau teks mentah, dan apa jua max_sentences yang anda minta. Panggilan yang gagal tidak dicaj.

Apa yang Disertakan:

Pengambilan halaman dan pembuangan elemen templat apabila anda menghantar url

Pemecahan ayat dengan penapisan serpihan pendek

Output perenggan, senarai bulet atau satu baris

Statistik panjang dan pemampatan

Metadata halaman pilihan (tajuk, penerangan, pengarang, tarikh)

Cadangan Pelan:

Free Plan: 1,000 credits percubaan sekali sahaja = 250 ringkasan

Hobby Plan: 5,000 credits = 1,250 ringkasan ($19/mo)

Professional Plan: 50,000 credits = 12,500 ringkasan ($99/mo)

Alat Berkaitan

extract_content
Dapatkan badan artikel dahulu, kemudian ringkaskannya (2 credits)
analyze_content
Ukur teks itu dan bukannya memendekkannya (3 credits)
extract_with_llm
Ringkasan abstraktif dan output berstruktur daripada model (3 credits)
deep_research
Ringkaskan merentas banyak sumber dan bukannya satu (10 credits)
Bersedia untuk mencuba summarize_content? Daftar secara percuma dan dapatkan 1,000 credits untuk mula membina.

Footer

CrawlForge MCP

Web scraping gred perusahaan untuk Ejen AI. 29 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.