summarize_content
Peringkasan ekstraktif: ayat diambil daripada sumber, tidak pernah ditulis semula. Alat ini memecahkan teks kepada ayat, membuang serpihan yang lebih pendek daripada 20 aksara, dan mengembalikan ayat-ayat awal dalam bentuk yang anda minta. Tiada model dipanggil, jadi halaman yang sama sentiasa diringkaskan dengan cara yang sama — dan tiada apa yang boleh direka.
Kes Penggunaan
Pratonton Suapan
Jana penggoda satu baris bagi setiap item dalam suapan pautan dengan summary_type: brief.
E-mel Ringkasan
Tukarkan senarai artikel kepada butiran bulet yang sedia untuk ditampal ke dalam surat berita.
Triaj Sebelum Membaca
Tentukan sama ada halaman yang panjang berbaloi untuk pengekstrakan penuh dengan melihat beberapa ayat pertamanya.
Cebisan Hasil Carian
Lampirkan cebisan yang konsisten dan boleh dipetik pada halaman terindeks, diambil kata demi kata daripada sumber.
Konteks Boleh Dipetik
Kerana ayat disalin dan bukannya diparafrasa, output boleh dipetik terus dan dirujuk.
Pra-Ringkasan Yang Murah
Kecilkan halaman sebelum menghantarnya kepada model bahasa, supaya model membayar lebih sedikit token.
Endpoint
/api/v1/tools/summarize_contentParameters
| Name | Type | Required | Default | Description |
|---|---|---|---|---|
url | string | Optional | - | Halaman yang akan diambil dan diringkaskan. Script, style, nav, header dan footer dibuang terlebih dahulu. Berikan sama ada `url` atau `content`. Example: https://example.com/blog/crawl-budgets |
content | string | Optional | - | Teks untuk diringkaskan terus, tanpa pengambilan. Hanya berkesan apabila `url` ditinggalkan — jika kedua-duanya dihantar, halaman yang diambil yang menang. Example: Search engines allocate a finite number of requests... |
max_sentences | number | Optional | 5 | Berapa banyak ayat untuk dikekalkan, 1 hingga 20. Diabaikan apabila `summary_type` ialah `brief`, yang sentiasa mengembalikan satu. Example: 3 |
summary_type | string | Optional | extractive | `extractive` mencantumkan ayat menjadi satu rentetan perenggan. `key_points` mengembalikannya sebagai tatasusunan rentetan, satu bagi setiap ayat. `brief` mengembalikan ayat pertama sahaja, sebagai rentetan. Example: key_points |
include_metadata | boolean | Optional | false | Tambah tajuk, penerangan, pengarang dan tarikh terbit halaman sebagai objek `metadata`. Hanya berkesan bersama `url` — tiada metadata untuk dibaca apabila anda menghantar `content`. Example: true |
timeout | number | Optional | 10000 | Had masa pengambilan dalam milisaat, antara 1000 dan 30000. Hanya terpakai apabila `url` digunakan. Example: 10000 |
respect_robots | boolean | Optional | true | Hormati robots.txt tapak sasaran. Dibiarkan pada `true`, laluan yang dilarang untuk `CrawlForge` ditolak dengan 403 sebelum apa-apa diambil dan tiada credits dicaj. Tetapkan kepada `false` hanya untuk sasaran yang anda mempunyai perjanjian sendiri dengannya — respons kemudiannya membawa entri `warnings` dan tindakan mengatasi itu direkodkan pada API key anda. Example: true |
Contoh Permintaan
curl -X POST https://crawlforge.dev/api/v1/tools/summarize_content \
-H "X-API-Key: cf_test_YOUR_KEY" \
-H "Content-Type: application/json" \
-d '{
"url": "https://example.com/blog/crawl-budgets",
"max_sentences": 3,
"summary_type": "extractive",
"include_metadata": true
}'Contoh Respons
{ "success": true, "data": { "summary": "Search engines allocate a finite number of requests to each site, and that allowance is what people mean by crawl budget. Large sites hit the ceiling long before small ones do, usually through duplicate URLs rather than genuine pages. Faceted navigation is the classic offender, generating thousands of near-identical addresses from a single catalogue.", "summary_type": "extractive", "original_length": 613, "summary_length": 352, "compression_ratio": 0.57, "sentences_used": 3, "total_sentences": 5, "metadata": { "title": "Why crawl budgets matter — Acme Blog", "description": "How search engines ration requests, and what to do about it.", "author": "Dana Reyes", "publish_date": "2026-08-14T09:30:00Z" } }, "credits_used": 4, "credits_remaining": 996, "processing_time": 540}data.summaryRentetan untuk `extractive` dan `brief`, tatasusunan rentetan untuk `key_points`. Taipkan klien anda dengan sewajarnyadata.original_lengthAksara teks sumber selepas HTML dibuang, bukan saiz mentah halamandata.compression_ratio`summary_length / original_length`, dibundarkan kepada dua perpuluhan. Lebih rendah bermakna ringkasan lebih padatdata.sentences_usedAyat yang benar-benar dikembalikan — lebih rendah daripada `max_sentences` pada halaman yang pendekdata.total_sentencesAyat yang ditemui dalam sumber, mengira hanya yang melebihi 20 aksara. Bandingkan dengan `sentences_used` untuk melihat berapa banyak yang ditinggalkandata.metadataHadir hanya apabila `include_metadata` ialah true dan `url` diberikan. Medan individu tidak ditakrifkan apabila halaman tidak mengisytiharkannyacredits_used4 credits tetap setiap panggilan, tidak kira panjang teksPengendalian Ralat
Tiada url mahupun content (400 Bad Request)
VALIDATION_ERROR. Sekurang-kurangnya satu daripada dua itu mesti ada. Status yang sama meliputi url yang cacat, max_sentences di luar 1-20, summary_type yang tidak dikenali, atau timeout di luar 1000-30000.
Halaman Terlalu Besar (413 Payload Too Large)
RESPONSE_TOO_LARGE. Halaman yang diambil melebihi had bacaan 25MB dan ditolak dan bukannya ditimbal.
Sasaran Tamat Masa (504 Gateway Timeout)
FETCH_TIMEOUT. Halaman berhenti bertindak balas semasa menghantar badannya. Naikkan timeout, sehingga 30000ms.
Pengambilan Gagal (502 Bad Gateway)
FETCH_FAILED. Badan respons tidak dapat dibaca — sambungan ditetapkan semula, atau badan yang bukan teks boleh nyahkod.
Peringkasan Gagal (500 Internal Server Error)
TOOL_ERROR. Panggilan yang gagal tidak dicaj; credits hanya ditolak selepas ringkasan dihasilkan.
Disekat oleh robots.txt (403 Forbidden)
robots.txt tapak sasaran melarang laluan ini untuk CrawlForge. Tetapkan respect_robots: false untuk mengatasinya jika anda mempunyai perjanjian sendiri dengan sasaran — tindakan mengatasi itu direkodkan pada API key anda. Tindakan mengatasi itu tidak sampai kepada hos yang berada dalam senarai penarikan diri kekal CrawlForge, yang ditolak tanpa mengira nilai respect_robots. Hanya bentuk url yang disemak — meringkaskan content yang anda berikan tidak mengambil apa-apa, jadi ia tidak boleh ditolak di sini.
No content to summarize di bawah brief, dan hasil kosong di bawah jenis yang lain, bukannya ralat. Periksa total_sentences sebelum menggunakan ringkasan itu.Kos Credit
max_sentences yang anda minta. Panggilan yang gagal tidak dicaj.Apa yang Disertakan:
Pengambilan halaman dan pembuangan elemen templat apabila anda menghantar url
Pemecahan ayat dengan penapisan serpihan pendek
Output perenggan, senarai bulet atau satu baris
Statistik panjang dan pemampatan
Metadata halaman pilihan (tajuk, penerangan, pengarang, tarikh)
Cadangan Pelan:
Free Plan: 1,000 credits percubaan sekali sahaja = 250 ringkasan
Hobby Plan: 5,000 credits = 1,250 ringkasan ($19/mo)
Professional Plan: 50,000 credits = 12,500 ringkasan ($99/mo)