Dla deweloperów, zespołów danych, badaczy i twórców agentów
Używaj tego przepływu do ograniczonego zbierania stron, ekstrakcji treści, danych badawczych i kontekstu publicznych stron.
Wybierz najniższy wystarczający tryb zbierania, zachowaj dowody miejsca docelowego i wzbogacaj wynik tylko wtedy, gdy wymaga tego przepływ.
Używaj tego przepływu do ograniczonego zbierania stron, ekstrakcji treści, danych badawczych i kontekstu publicznych stron.
Otrzymuj HTML, tekst lub Markdown oraz dowody końcowego miejsca docelowego i przetwarzania dla każdego obsługiwanego żądania.
Strona może przekierowywać, wymagać JavaScript, przekroczyć ograniczony rozmiar odpowiedzi lub ujawniać tylko część potrzebnego kontekstu.
DomScan nie omija uwierzytelniania, paywalli, kontroli dostępu ani ograniczeń celu i nie obiecuje zebrania każdego publicznego URL.
Otrzymuj HTML, tekst lub Markdown oraz dowody końcowego miejsca docelowego i przetwarzania dla każdego obsługiwanego żądania.
Użyj URL Intelligence lub Redirects, gdy przed zebraniem trzeba sprawdzić miejsce docelowe albo sygnały ryzyka URL.
Zacznij od standardowego Scrape, wybieraj odporne ponowienia tylko wtedy, gdy są przydatne, a renderowanie stosuj wyłącznie dla treści zależnych od JavaScript.
Po zebraniu zażądaj Website Categorization lub Technology Detection, jeśli zadanie dalsze potrzebuje tych sygnałów.
Wyślij URL artykułu w trybie standardowym, zachowaj końcowy URL i dodaj dane kategorii tylko, jeśli aplikacja ich używa.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Otrzymuj HTML, tekst lub Markdown oraz dowody końcowego miejsca docelowego i przetwarzania dla każdego obsługiwanego żądania.
Pobieraj publiczne strony internetowe jako HTML, Markdown lub tekst, korzystając z opcji synchronicznych i asynchronicznych.
Wybierz, gdy: Pobieraj publiczne strony internetowe jako HTML, Markdown lub tekst, korzystając z opcji synchronicznych i asynchronicznych.
Pobieraj z adresu URL znormalizowane metadane strony, pola podglądu, dane strukturalne i sygnały publicznej tożsamości.
Wybierz, gdy: Pobieraj z adresu URL znormalizowane metadane strony, pola podglądu, dane strukturalne i sygnały publicznej tożsamości.
Kategoryzuj witrynę wg branży, typu zawartości i tematów.
Wybierz, gdy: Kategoryzuj witrynę wg branży, typu zawartości i tematów.
Dodawaj wiele obsługiwanych żądań API do kolejki i odbieraj ich wyniki bez utrzymywania otwartego połączenia klienta.
Wybierz, gdy: Dodawaj wiele obsługiwanych żądań API do kolejki i odbieraj ich wyniki bez utrzymywania otwartego połączenia klienta.
Potrzebujesz ograniczonej publicznej treści z jawnym kontekstem miejsca docelowego, trybu i przetwarzania.
Nie używaj do omijania kontroli dostępu, nieograniczonego crawlowania witryny ani gwarantowania zebrania każdego celu.
Wybierz najniższy wystarczający tryb zbierania, zachowaj dowody miejsca docelowego i wzbogacaj wynik tylko wtedy, gdy wymaga tego przepływ.