Langkau ke kandungan

CrawlForge TeamPasukan Kejuruteraan

5 min bacaan

API penyelidikan pasaran untuk perunding: dari kosong kepada vendor tersenarai

Penyelidikan pasaran seorang perunding bermula semula dengan setiap projek. Kategori baharu, senarai vendor baharu, dan seorang klien yang akan bertanya pada slaid keempat belas dari mana angka itu datang. Hamparan suku tahun lepas tidak boleh dipindahkan. Kaedahnya boleh.

API penyelidikan pasaran untuk perunding perlu berfungsi dari kosong, kerana pada hari pertama tiada senarai vendor untuk ditujukan kepadanya, dan ia perlu memulangkan fakta berserta sumber dan tarikh, kerana "kami sudah semak" bukan jawapan yang boleh diberikan oleh seorang rakan kongsi. Ia juga perlu berbelanja sesuatu yang boleh anda kenakan kepada satu klien, bukan kepada kos overhed.

Dari mana anda bermula apabila belum ada senarai vendor?

Dengan dua panggilan yang memulangkan URL, bukan jawapan. search_web berharga 5 credits setiap pertanyaan dan menerima satu array queries, jadi enam cara menyoal "siapa menjual X kepada Y" berjalan dalam satu panggilan dengan kos 30 credits. Cebisan teks biasanya sudah cukup untuk membezakan vendor sebenar daripada sekadar artikel senarai. Apabila anda mahukan petikan sekali, deep_research berharga 10 credits setiap larian: ia mencari, mendapatkan sehingga sepuluh sumber dan memulangkan petikan yang paling sepadan secara verbatim, berserta senarai sources yang membawa URL, tajuk setiap satu, dan sama ada ia benar-benar dicapai atau hanya dilihat dalam cebisan teks. Tiada apa yang disintesis pada API terhos, dan itulah intipatinya. Apa yang kembali ialah senarai panjang domain berserta ayat-ayat yang meletakkannya di situ.

Langkah seterusnya ialah mencari halaman yang betul pada setiap domain, dan cara yang salah ialah meneka bahawa harga terletak di /pricing. map_site berharga 2 credits setiap domain dan membaca sitemap tapak itu, beralih kepada perayapan terhad apabila tiada sitemap, jadi anda mendapat senarai URL dan memilih halaman harga, produk, pelanggan dan kerjaya daripadanya. Tiga puluh vendor ialah 60 credits dan anda tidak sekali pun mencapai 404.

Bagaimana sesuatu fakta masuk ke dalam slaid berserta sumbernya?

Satu scrape bagi setiap halaman. Minta markdown, metadata dan links sekali gus: setiap format datang daripada capaian yang sama dan panggilan itu berharga 2 credits tidak kira berapa banyak yang anda minta. Respons itu membawa cap masa scraped_at, iaitu lajur tarikh yang diperlukan oleh penyampaian anda kepada klien.

Bash
curl -X POST https://crawlforge.dev/api/v1/tools/scrape \
  -H "X-API-Key: cf_live_NORTHWIND_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "url": "https://vendor-a.com/pricing",
    "formats": ["markdown", "metadata", "links"]
  }'

Baris yang anda tulis ialah vendor, URL halaman, dakwaan itu, ayat yang menjadi sandarannya, dan scraped_at. Petik ayat itu, bukan menulis semula dengan kata-kata sendiri. Satu sel yang menyatakan "SSO pada semua pelan" hanyalah pendapat sehingga ayat di sebelahnya mengesahkannya, dan catatan tentang usaha wajar (due diligence) mengupas apa yang berlaku apabila satu model mengisi sel itu sebaliknya.

Jika soalan yang sama perlu dijawab bagi setiap vendor, tambah satu format question dengan kos tambahan 1 credit dan panggilan itu memulangkan lima ayat yang paling sepadan, masing-masing dengan offset ke dalam markdown. Catatan RevOps mengenai menjalankan itu merentas satu kategori; catatan ini mengenai mendapatkan kategori itu pada mulanya.

Bagaimana anda memisahkan perbelanjaan seorang klien daripada klien yang lain?

Cipta satu kunci API bagi setiap klien dan namakan ia sempena projek itu. Satu akaun membenarkan sehingga sepuluh, iaitu lebih banyak projek serentak daripada yang dijalankan oleh kebanyakan firma perundingan. Setiap panggilan yang dibuat dengan kunci itu menulis satu baris ke dalam log permintaan yang membawa alat itu, URL sasaran, credits yang dicaj dan kunci yang menjadi asalnya, dan log itu disaring mengikut kunci serta dieksport sebagai CSV.

Itu melakukan dua perkara yang tidak diminta sesiapa sehingga mereka memerlukannya. Perbelanjaan projek itu menjadi satu pertanyaan, bukan satu pembinaan semula, dan penyelidikan seorang klien boleh diasingkan daripada penyelidikan orang lain apabila mereka bertanya apa yang anda simpan. Semasa penutupan, padam kunci itu. Pemadaman membatalkannya tetapi mengekalkan baris-baris itu, jadi rekod tentang apa yang diambil untuk siapa terus wujud melebihi tempoh projek itu.

Contoh di atas meletakkan nama klien dalam nama kunci itu atas sebab yang sama: nama itulah yang akan anda gunakan untuk menyaring.

Berapakah kos satu projek?

Tinjauan 30 vendor, dibuat dengan cara di atas:

LangkahPanggilanCredits
Senarai panjang: enam cara carian, satu larian deep_research1 + 140
Mencari halaman: map_site bagi setiap vendor3060
Membaca empat halaman bagi setiap vendor120240
Satu soalan ditanya kepada setiap halaman harga3090
Jumlah projek430

1,000 credits sekali sahaja pada peringkat percuma menampung dua daripadanya. Selepas itu satu pek 1K berharga $3 dan satu pek 5K berharga $14, dibeli apabila sesuatu projek memerlukannya berbanding pelan bulanan, dan itu hujah yang berasingan. Pada kadar pek, seluruh tinjauan di atas berharga kira-kira satu dolar setengah, cukup kecil untuk dibawa dalam yuran dan cukup boleh diaudit sekiranya seorang klien bertanya apa yang diliputi oleh baris itu.

Apa yang ia tidak akan lakukan?

  • Tiada angka saiz pasaran. Ia tidak mengukur apa-apa dan tidak meramal apa-apa. Jika slaid itu memerlukan TAM, itu datang daripada satu laporan atau set data.
  • Tiada data hubungan atau firmografik. Ia membaca halaman yang anda tunjukkan kepadanya. Ia bukan pangkalan data syarikat dan tidak bertindih dengan satu.
  • Tiada log masuk klien. Satu akaun, kunci bagi setiap klien, dan klien melihat apa yang anda hantar kepada mereka.
  • robots.txt dihormati secara lalai. Halaman yang tidak dibenarkan ditolak sebelum apa-apa dicapai dan tidak dicaj apa-apa, dan mematikan semakan itu direkodkan terhadap kunci anda.

Apabila projek itu bertukar menjadi tugasan berterusan dan soalannya menjadi "beritahu saya apabila ini berubah", jawapannya ialah satu monitor bagi setiap klien, bukan menjalankan semula ini secara berjadual.

Mulakan secara percuma dengan 1,000 credits, cipta satu kunci yang dinamakan sempena projek anda yang seterusnya, dan bina satu tinjauan sebelum anda membina apa-apa di sekelilingnya.

Cuba sendiri — tiada pendaftaran diperlukan

Terokai kesemua 31 alat scraping dan pengekstrakan CrawlForge dalam playground, kemudian mula secara percuma dengan 1,000 credits.

1,000 credits percuma • Sekali sahaja • Tiada kad kredit diperlukan

Tag

  • consultants
  • market research
  • scrape
  • map_site
  • deep_research
  • b2b

Tentang Penulis

CrawlForge Team

Pasukan Kejuruteraan

Membina MCP server web scraping yang paling menyeluruh. Kami mencipta alatan yang membantu pembangun mengekstrak, menganalisis dan mengubah data web untuk aplikasi AI.

Surat berita

Kekal dikemas kini dengan pandangan terkini

Dapatkan tutorial, kemas kini produk dan petua web scraping terus ke peti masuk anda.

Tiada spam. Berhenti melanggan bila-bila masa.

Soalan Lazim

Soalan lazim

01Adakah CrawlForge penyedia data penyelidikan pasaran untuk perunding?

Tidak. Ia tidak memiliki anggaran saiz pasaran, data firmografik, isyarat niat atau rekod hubungan. Ia membaca halaman awam yang anda tunjukkan kepadanya dan memulangkan apa yang tertulis di situ, berserta URL dan cap masa. Bagi sesuatu projek perundingan, itu menjadikannya lapisan yang membina dan memetik sumber tinjauan itu daripada tapak vendor sendiri, di samping mana-mana laporan bersindiket atau set data yang sudah dilesenkan oleh firma itu.

02Bagaimana saya mencari vendor dalam kategori yang belum pernah saya selidiki?

search_web berharga 5 credits setiap pertanyaan dan menerima satu array queries, jadi beberapa cara menyoal berjalan dalam satu panggilan dan dicaj bagi setiap pertanyaan yang memulangkan hasil. deep_research berharga 10 credits setiap larian dan memulangkan petikan verbatim berserta satu senarai sources dengan URL, tajuk setiap satu dan sama ada ia dicapai. Kedua-duanya memulangkan URL, bukan jawapan yang sudah ditulis, dan itulah yang anda mahukan pada peringkat senarai panjang. map_site kemudian menyenaraikan halaman setiap domain untuk 2 credits, jadi anda memilih halaman harga atau produk berbanding meneka laluannya.

03Bolehkah saya mengasingkan penggunaan seorang klien daripada klien yang lain?

Boleh. Cipta satu kunci API bernama bagi setiap klien; satu akaun membenarkan sehingga sepuluh. Setiap panggilan mencatat kunci yang menjadi asalnya bersama alat itu, URL dan credits yang dicaj, dan log permintaan pada papan pemuka disaring mengikut kunci serta dieksport sebagai CSV. Memadam satu kunci semasa penutupan membatalkannya tetapi mengekalkan baris-barisnya, jadi rekod projek itu terus wujud melebihi kunci tersebut.

04Perlukah saya melanggan untuk menjalankan satu projek?

Tidak. Peringkat percuma memberikan 1,000 credits sekali sahaja, cukup untuk dua tinjauan 30 vendor pada kos yang dikira di atas. Selepas itu, pek credits sekali guna bermula pada $3 untuk 1,000 dan $14 untuk 5,000, jadi sebuah firma yang menjalankan penyelidikan secara berkala boleh membeli mengikut projek berbanding membayar setiap bulan. Pelan berbayar wujud untuk firma yang mahukan peruntukan bulanan dengan pindahan baki.

05Mengapa tidak gunakan batch_scrape untuk seluruh senarai vendor sekali gus?

Pada REST API terhos, batch_scrape mencaj 5 credits bagi setiap URL yang dicubanya dan memulangkan teks biasa, sedangkan scrape mencaj 2 bagi setiap halaman dan memulangkan markdown, metadata dan pautan daripada satu capaian. Batch ialah satu perjalanan pergi-balik dan menyimpan hasilnya selama 24 jam, yang memudahkan, tetapi bagi satu tinjauan yang akan anda baca dengan teliti, gelung panggilan scrape berharga kurang daripada separuh dan memberikan anda lebih banyak bahan untuk dipetik.

Teruskan membaca

Artikel Berkaitan