API Dokümanlar
Scrapling Cloud, temiz web verisi gereken ürünler için scrape / crawl / map / extract / search / monitor API'sidir. Taban URL: https://api.scrape.seymata.com
curl -X POST https://api.scrape.seymata.com/v1/scrape \
-H "Authorization: Bearer sk_..." \
-H "Content-Type: application/json" \
-d '{"url":"https://example.com","formats":["markdown"]}'Kimlik doğrulama
Tüm /v1 uç noktaları Bearer API anahtarı ister. Anahtarı Dashboard'dan alın ve Authorization başlığında gönderin.
/v1/auth/signupHesap + organizasyon + ilk API anahtarı oluştur
{ "email": "you@firma.com", "password": "en-az-8", "organization_name": "Firmam" }/v1/auth/loginGiriş yap, panel API anahtarı al
{ "email": "you@firma.com", "password": "..." }/v1/meGeçerli hesabı döndür
/v1/usagePlan, kredi ve eşzamanlılık limiti
Scrape
Tek bir sayfayı istediğiniz formatlarda çekin. Async iş döner; /v1/jobs/{id} ile sonucu alın veya SSE ile canlı izleyin.
/v1/scrapeFormats: markdown, html, raw_html, text, links, images, metadata, screenshot, summary, json
{ "url": "https://example.com", "formats": ["markdown","screenshot"], "mode": "auto", "only_main_content": true, "change_tracking": false, "max_age": 0 }mode: auto | static | dynamic | stealth. screenshot_full_page, include_tags, exclude_tags, headers, mobile, timeout, proxy da desteklenir.
Crawl
Bir siteyi aynı alan adı içinde gezin; sayfa ve derinlik limitleri, regex filtreleri, robots.txt saygısı.
/v1/crawlSite geneli gezinme + isteğe bağlı AI analizi
{ "url": "https://site.com", "limit": 50, "max_depth": 2, "include": ["/blog/"], "exclude": ["/tag/"], "allow_subdomains": false, "respect_robots": true, "delay": 0 }Map
Hızlı URL keşfi: robots.txt + sitemap.xml + sayfa linkleri. Tam scrape yapmaz, sadece URL listeler.
/v1/mapURL keşfi (senkron)
{ "url": "https://site.com", "limit": 250, "include_subdomains": false, "sitemap": "include", "search": "opsiyonel filtre" }Extract
Bir veya çok sayıda URL'den yapılandırılmış veri çıkarın. site.com/* joker adresi map ile genişletilir.
/v1/extractŞema ve/veya prompt ile LLM çıkarımı
{ "urls": ["https://site.com", "https://site.com/blog/*"], "prompt": "Başlık ve tarihleri çıkar", "schema": { "type": "object", "properties": { "articles": { "type": "array" } } } }Search
Web araması (self-host SearXNG). Sonuçları isteğe bağlı olarak scrape edip markdown ekleyebilir.
/v1/searchWeb araması + opsiyonel sonuç scrape
{ "query": "Horizon Europe calls 2026", "limit": 10, "scrape_formats": ["markdown"], "time_range": "month" }Batch & Intel
Çok sayıda URL'yi paralel işleyin; Intel akışı Excel/CSV yükleyip sosyal medya + firma analizini çıkarır.
/v1/batchURL listesini paralel scrape et
{ "urls": ["https://a.com","https://b.com"], "formats": ["markdown"], "max_concurrency": 5 }/v1/intel/uploadExcel/CSV/TXT yükle → toplu firma istihbaratı (multipart)
/v1/intel/{job_id}/exportBiçimli .xlsx indir
Parse
Yerel bir dosyayı (PDF/DOCX/XLSX/HTML/TXT/CSV/MD) markdown'a çevirin. Ağ isteği yok.
/v1/parseDosya → markdown (multipart, ≤25MB)
Monitors
Bir sayfayı zamanlanmış olarak izleyin; değişince (isteğe bağlı AI 'anlamlı değişiklik' yargısıyla) webhook bildirimi alın.
/v1/monitorsİzleyici oluştur
{ "name": "EU çağrıları", "url": "https://ec.europa.eu/...", "interval_minutes": 60, "judge_enabled": true, "goal": "Yeni fon çağrısı", "webhook_url": "https://firma.com/hook", "notify_on": "meaningful" }/v1/monitorsİzleyicileri listele
/v1/monitors/{id}İzleyici + son 20 kontrol
/v1/monitors/{id}/runŞimdi çalıştır
/v1/monitors/{id}İzleyiciyi sil
Faturalama
Planlar ve Stripe self-servis abonelik. Webhook aboneliği plan/kredi değişimlerini işler.
/v1/billing/plansPlan kataloğu (starter/growth/scale)
/v1/billing/checkoutStripe ödeme oturumu başlat
{ "plan": "growth", "success_url": "https://.../ok", "cancel_url": "https://.../iptal" }/v1/billing/portalMüşteri portalı oturumu
{ "return_url": "https://.../hesap" }SDK & MCP
Resmi Python istemcisi ve MCP server ile kod içinden veya AI istemcilerinden erişin.
from scrapling_cloud_sdk import ScraplingCloud
client = ScraplingCloud(api_key="sk_...")
page = client.scrape("https://example.com", formats=["markdown"])
print(page["markdown"])SCRAPLING_API_KEY=sk_... \ python -m scrapling_cloud.mcp_server