CrawlForge
Laman UtamaPlaygroundKes PenggunaanIntegrasiHargaDokumentasiBlog
Scrape Amazon, LinkedIn & 8 Laman Lagi Dengan Satu Alat
Use Cases
Kembali ke Blog
Kes Penggunaan

Scrape Amazon, LinkedIn & 8 Laman Lagi Dengan Satu Alat

C
CrawlForge Team
Pasukan Kejuruteraan
27 Mei 2026
8 min bacaan

Pada halaman ini

Jawapan Pantas

scrape_template ialah alat CrawlForge dengan skema prabina dan terselenggara untuk sepuluh laman popular: Amazon, LinkedIn, GitHub, YouTube, Reddit, Hacker News, Stack Overflow, npm, Product Hunt dan Twitter/X. Satu panggilan memulangkan JSON berstruktur. Tiada pemilih CSS diperlukan. Berkos 1 credit setiap scrape.

Separuh daripada permintaan scraping yang kami lihat di CrawlForge ialah sepuluh laman yang sama: Amazon, LinkedIn, GitHub, YouTube, Reddit, Hacker News, Stack Overflow, npm, Product Hunt dan Twitter/X. Kami bosan melihat orang menulis pemilih CSS yang sama berulang kali -- dan melihat pemilih itu rosak pada kali seterusnya laman tersebut mengemas kini reka letaknya. Jadi kami buat kerja itu sekali sahaja, membungkusnya sebagai scrape_template, dan kini anda membayar 1 credit dan mendapat JSON berstruktur.

Isi Kandungan

  • Apakah scrape_template?
  • 10 Laman yang Disokong
  • Mula Pantas: Scrape Produk Amazon
  • Profil LinkedIn (Dengan Nota Undang-undang)
  • Repo GitHub untuk Data Latihan AI
  • Tujuh Templat Yang Lain
  • scrape_template vs scrape_structured vs extract_with_llm
  • Batasan

Apakah scrape_template?

scrape_template ialah satu alat CrawlForge dengan sepuluh skema laman prabina. Anda pilih templat, hantar URL, dan dapatkan kembali JSON berstruktur yang sepadan dengan bentuk semula jadi laman tersebut. Tiada pemilih CSS. Tiada penghuraian HTML. Tiada definisi skema.

Tukar gantinya: anda hanya mendapat sepuluh laman yang kami selenggara. Jika anda perlukan sesuatu yang lain, gunakan scrape_structured (mengutamakan CSS) atau extract_with_llm (mengutamakan LLM). Untuk permintaan jangka panjang seperti "Saya mahukan data produk dari Amazon", scrape_template ialah laluan terpendek. Perlukan aliran kerja berbilang langkah dan bukannya satu laman? Lihat cara menggunakan galeri templat.

Ia berkos 1 credit setiap scrape -- sama seperti fetch_url asas -- kerana kami sudah pun menyelesaikan kerja skema di hulu.

10 Laman yang Disokong

TemplatMemulangkanTerbaik untukCorak URL contoh
amazon-productTajuk, harga, penilaian, kiraan ulasan, imej, ASIN, ketersediaanPemantauan harga, penyelidikan produk/dp/<ASIN>
linkedin-profileNama, tajuk utama, lokasi, tentang, syarikat semasaPengayaan prospek/in/<handle>
github-repoBintang, fork, bahasa, topik, lesen, kemas kini terakhirAnalisis repo, data latihan AI/<owner>/<repo>
youtube-videoTajuk, saluran, tontonan, tempoh, diterbitkan, perihalanPenyelidikan kandungan/watch?v=<id>
reddit-threadTajuk siaran, skor, pengarang, subreddit, badanIsyarat komuniti/r/<sub>/comments/<id>
hacker-news-front-pageCerita muka depan: tajuk, URL, skor, pengarang, komenPenjejakan trend teknologinews.ycombinator.com
stackoverflow-questionSoalan, jawapan diterima, kiraan undi, tagPerlombongan Soal Jawab pembangun/questions/<id>
npm-packageMetadata pakej, muat turun mingguan, versi, penyelenggaraAnalisis kebergantungan/package/<name>
producthunt-launchProduk, slogan, undi naik, topik, laman webPemantauan pelancaran/posts/<slug>
tweetTeks, pengarang, URL, imejPendengaran sosial/<user>/status/<id>

Mula Pantas: Scrape Produk Amazon

Bash
crawlforge template amazon-product "https://www.amazon.com/dp/B0CHX1W1XY"

Output:

Json
{
  "asin": "B0CHX1W1XY",
  "title": "Logitech MX Master 3S Wireless Performance Mouse",
  "price": { "amount": 99.99, "currency": "USD" },
  "rating": 4.7,
  "review_count": 12483,
  "in_stock": true,
  "images": ["https://m.media-amazon.com/...", "..."],
  "credits_used": 1
}

Daripada klien MCP seperti Claude Code:

"Gunakan scrape_template dengan templat amazon untuk mendapatkan harga dan penilaian semasa bagi ASIN B0CHX1W1XY."

Claude memilih alat, memformat panggilan, dan memulangkan data. Satu credit.

Profil LinkedIn (Dengan Nota Undang-undang)

Bash
crawlforge template linkedin-profile "https://www.linkedin.com/in/satyanadella"

Output:

Json
{
  "name": "Satya Nadella",
  "headline": "Chairman and CEO at Microsoft",
  "location": "Redmond, Washington",
  "current_role": { "title": "CEO", "company": "Microsoft", "since": "2014-02" },
  "experience_count": 6,
  "skills_top": ["Leadership", "Strategy", "Cloud Computing"],
  "credits_used": 1
}

Satu nota tentang scraping LinkedIn. Terma perkhidmatan LinkedIn menyekat akses automatik. Kes hiQ Labs v. LinkedIn (Litar ke-9, 2022) menetapkan bahawa scraping data profil awam pada amnya dibenarkan, tetapi penggunaan komersial, scraping yang memerlukan log masuk, dan kekerapan yang agresif masih boleh mencetuskan tindakan undang-undang dan larangan ToS. Gunakan scrape_template dengan templat linkedin-profile untuk data awam, berkekerapan rendah, dan tidak dijual semula sahaja.

Repo GitHub untuk Data Latihan AI

Bash
crawlforge template github-repo "https://github.com/anthropics/anthropic-sdk-python"

Output:

Json
{
  "owner": "anthropics",
  "name": "anthropic-sdk-python",
  "stars": 1842,
  "forks": 287,
  "primary_language": "Python",
  "languages": { "Python": 98.4, "Makefile": 1.6 },
  "license": "MIT",
  "topics": ["claude", "anthropic", "sdk"],
  "readme_markdown": "# Anthropic Python SDK...",
  "last_commit_at": "2026-05-19T14:22:11Z",
  "credits_used": 1
}

Templat ini banyak digunakan untuk talian paip data latihan AI -- menarik README secara berskala merentas beribu-ribu repo. Gandingkannya dengan batch_scrape untuk memproses CSV URL repo.

Tujuh Templat Yang Lain

YouTube -- tajuk, saluran, tontonan, transkrip penuh apabila tersedia:

Bash
crawlforge template youtube-video "https://www.youtube.com/watch?v=dQw4w9WgXcQ"

Reddit -- siaran + pokok komen:

Bash
crawlforge template reddit-thread "https://www.reddit.com/r/programming/comments/<id>"

Hacker News -- muka depan sebagai senarai cerita:

Bash
crawlforge template hacker-news-front-page "https://news.ycombinator.com"
# memulangkan sehingga 30 cerita muka depan; hiris 10 teratas dengan jq:
crawlforge template hacker-news-front-page "https://news.ycombinator.com" --json | jq '.stories[:10]'

Stack Overflow -- soalan, jawapan diterima, alternatif teratas:

Bash
crawlforge template stackoverflow-question "https://stackoverflow.com/questions/12345678"

npm -- metadata pakej + muat turun mingguan:

Bash
crawlforge template npm-package "https://www.npmjs.com/package/next"

Product Hunt -- produk, pembuat, undi naik:

Bash
crawlforge template producthunt-launch "https://www.producthunt.com/posts/crawlforge"

Twitter/X -- satu tweet dengan penglibatan dan balasan:

Bash
crawlforge template tweet "https://x.com/elonmusk/status/<id>"

Semuanya memulangkan JSON. Semuanya berkos 1 credit. Semuanya diselenggara secara berpusat -- apabila LinkedIn atau Amazon mengemas kini reka letak mereka, kami mengemas kini templat.

scrape_template vs scrape_structured vs extract_with_llm

Pokok keputusan:

Is your target one of the 10 supported sites? Yes -> use scrape_template (1 credit, maintained for you) No Do you know the CSS selectors and are they stable? Yes -> use scrape_structured (2 credits, you maintain selectors) No -> use extract_with_llm (3 credits, schema-based, layout-resilient)

Perbandingan pantas:

scrape_templatescrape_structuredextract_with_llm
Credits123
Liputan10 laman tertentuMana-mana laman yang anda boleh tulis pemilih untuknyaMana-mana laman
PenyelenggaraanKami selenggaraAnda selenggaraLLM menyesuaikan diri
KelajuanPantas (skema dicache)PantasLebih perlahan (panggilan LLM)
Terbaik untukLaman popular, volum tinggiStruktur tertentu yang diketahuiStruktur yang tidak diketahui atau berubah

Batasan

  • Hanya 10 laman. Jika anda perlukan Etsy, eBay, TikTok, atau yang lain, anda sedang menunggu peta jalan atau membina sendiri dengan scrape_structured / extract_with_llm. Minta templat di Discord.
  • Data awam sahaja. Tiada templat memerlukan log masuk. Profil yang ditetapkan sebagai peribadi, repo berpagar, dan tweet yang dilindungi hanya akan memulangkan apa yang kelihatan secara awam sahaja.
  • Perubahan reka letak berlaku. Apabila sesebuah laman melancarkan reka bentuk semula, kami biasanya menampal templat dalam masa 24 jam.
  • Had kadar dikenakan. Scraping LinkedIn atau Amazon bervolum tinggi harus menggandingkan scrape_template dengan stealth_mode (5 credits) dan menghormati robots.txt setiap laman.

Sedia untuk melangkau pemilih? Mula percuma dengan 1,000 credits -- cukup untuk 1,000 scrape templat. Baru di sini? Baca siaran pelancaran v4.2.2 untuk konteks, atau panduan pengekstrakan e-dagang untuk aliran kerja dunia sebenar yang dibina sekitar templat ini.

Cuba sendiri — tiada pendaftaran diperlukan

Jalankan mana-mana daripada 27 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Isi semula setiap bulan • Tiada kad kredit diperlukan

Tag

scrape-templateAmazonLinkedInGitHubuse-casespre-built-scrapers

Tentang Penulis

C

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Praktikkan ini

Uji alat CrawlForge pada mana-mana URL — percuma, tanpa pendaftaran.

Pada halaman ini

Frequently Asked Questions

Apakah laman yang disokong oleh scrape_template?+

Sepuluh laman dalam v4.2.2: Amazon, LinkedIn, GitHub, YouTube, Reddit, Hacker News, Stack Overflow, npm, Product Hunt dan Twitter/X. Setiap satu mempunyai skema prabina yang memulangkan medan yang biasanya anda mahukan (harga/penilaian produk, nama/peranan profil, bintang/README repo, transkrip video, dsb.). Lebih banyak templat akan datang dalam v4.3.

Adakah scraping LinkedIn sah dari segi undang-undang?+

Kes hiQ Labs v. LinkedIn (Litar ke-9, 2022) menetapkan bahawa scraping data profil awam pada amnya dibenarkan, tetapi ToS LinkedIn menyekat akses automatik -- dan scraping yang agresif atau penjualan semula komersial masih boleh mencetuskan tindakan undang-undang dan larangan. Gunakan scrape_template dengan templat linkedin-profile untuk kes penggunaan awam, berkekerapan rendah, dan tidak dijual semula. Rujuk peguam jika anda melakukan scraping secara berskala atau untuk produk komersial.

Bolehkah saya menambah templat tersuai?+

Tidak secara langsung pada hari ini, tetapi kami menerima permintaan templat di Discord dan mengutamakan mengikut permintaan. Laman dengan volum permintaan yang ketara (Etsy, eBay, TikTok, Instagram, Google Maps) berada dalam peta jalan untuk v4.3. Untuk kerja tersuai sekali sahaja, gunakan scrape_structured (pemilih CSS) atau extract_with_llm (dipacu skema).

Apakah perbezaan antara scrape_template dan scrape_structured?+

scrape_template adalah untuk sepuluh laman tertentu yang kami sudah selenggarakan skemanya -- anda hanya pilih nama templat. scrape_structured adalah tujuan umum: anda menyediakan pemilih CSS untuk mana-mana laman, dan CrawlForge menjalankannya. Templat lebih pantas dan lebih murah (1 credit vs 2) apabila sasaran anda ialah salah satu daripada sepuluh laman yang disokong.

Sejauh manakah segar skema scrape_template?+

Kami memantau setiap laman yang disokong untuk perubahan reka letak dan biasanya menghantar tampung templat dalam masa 24 jam selepas sebarang perubahan yang merosakkan. Kemas kini adalah lutsinar kepada kod anda -- anda terus memanggil nama templat yang sama dan bentuk data kekal sama. Jika anda perasan regresi, laporkannya di Discord atau GitHub.

Apa yang berlaku jika laman yang disokong mengubah reka letaknya?+

Panggilan terus memulangkan JSON dalam bentuk yang didokumenkan, walaupun pemilih asas perlu berubah. Kami menanggung beban penyelenggaraan supaya anda tidak perlu. Jika perubahan reka letak cukup teruk untuk merosakkan sesuatu medan buat sementara waktu, kami menandakan medan itu sebagai nullable dalam respons sehingga tampung tersedia (biasanya dalam masa 24 jam).

Artikel Berkaitan

Web Scraping mengikut Industri: Buku Panduan 2026
Use Cases

Web Scraping mengikut Industri: Buku Panduan 2026

Strategi web scraping khusus industri untuk hartanah, kewangan, e-dagang, penjagaan kesihatan, dan pelancongan. Sasaran data, alat CrawlForge, dan peraturan pematuhan.

C
CrawlForge Team
|
14 Apr
|
12m
Pengekstrakan Data Produk E-dagang pada Skala
Use Cases

Pengekstrakan Data Produk E-dagang pada Skala

Ekstrak data produk daripada ribuan halaman e-dagang dengan CrawlForge. Bina katalog, pantau inventori, dan kuasakan enjin perbandingan pada skala.

C
CrawlForge Team
|
18 Apr
|
10m
Bina Ejen Penyelidikan dengan CrawlForge Deep Research
Use Cases

Bina Ejen Penyelidikan dengan CrawlForge Deep Research

Cipta ejen penyelidikan AI yang mengumpul, mengesahkan, dan mensintesis maklumat daripada berpuluh-puluh sumber dalam beberapa minit menggunakan CrawlForge deep_research.

C
CrawlForge Team
|
16 Apr
|
10m

Footer

CrawlForge

Web scraping gred perusahaan untuk Ejen AI. 27 alat MCP khusus yang direka untuk pembangun moden yang membina sistem pintar.

Produk

  • Ciri
  • Playground
  • Harga
  • Kes Penggunaan
  • Integrasi
  • Alternatif
  • Changelog

Sumber

  • Mula Bekerja
  • Rujukan API
  • Templat
  • Panduan
  • Blog
  • Glosari
  • Soalan Lazim
  • Peta Laman

Pembangun

  • Protokol MCP
  • Claude Desktop
  • Cursor IDE
  • LangChain
  • LlamaIndex

Syarikat

  • Tentang
  • Hubungi
  • Privasi
  • Terma
  • Penggunaan Boleh Diterima
  • Cookies

Kekal dikemas kini

Dapatkan kemas kini terkini tentang alat dan ciri baharu.

Dibina dengan Next.js dan protokol MCP

© 2025-2026 CrawlForge. Hak cipta terpelihara.