Voor ontwikkelaars, datateams, onderzoekers en agentbouwers
Gebruik deze workflow voor begrensde paginaverzameling, inhoudsextractie, onderzoeksinvoer en context van openbare pagina’s.
Kies de laagste voldoende verzamelmodus, bewaar bestemmingsbewijs en verrijk het resultaat alleen wanneer de workflow dat nodig heeft.
Gebruik deze workflow voor begrensde paginaverzameling, inhoudsextractie, onderzoeksinvoer en context van openbare pagina’s.
Ontvang HTML, tekst of markdown plus bewijs van de uiteindelijke bestemming en verwerking voor elk ondersteund verzoek.
De pagina kan redirecten, JavaScript vereisen, de begrensde responsgrootte overschrijden of slechts een deel van de benodigde context tonen.
DomScan omzeilt geen authenticatie, paywalls, toegangscontroles of doelwitbeperkingen en belooft niet dat elke openbare URL kan worden verzameld.
Ontvang HTML, tekst of markdown plus bewijs van de uiteindelijke bestemming en verwerking voor elk ondersteund verzoek.
Gebruik URL Intelligence of Redirects wanneer bestemming of URL-risicosignalen vóór verzameling moeten worden gecontroleerd.
Begin met standaard Scrape, kies veerkrachtig retrygedrag alleen wanneer nuttig en gebruik rendering alleen voor JavaScript-afhankelijke inhoud.
Vraag Website Categorization of Technology Detection na de verzameling op wanneer de vervolgtaken die signalen nodig hebben.
Dien de artikel-URL in de standaardmodus in, bewaar de uiteindelijke URL en voeg categoriegegevens alleen toe als de applicatie die gebruikt.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Ontvang HTML, tekst of markdown plus bewijs van de uiteindelijke bestemming en verwerking voor elk ondersteund verzoek.
Haal openbare webpagina’s op als HTML, Markdown of tekst, met synchrone en asynchrone opties.
Kies dit wanneer: Haal openbare webpagina’s op als HTML, Markdown of tekst, met synchrone en asynchrone opties.
Extraheer genormaliseerde paginametadata, previewvelden, gestructureerde gegevens en openbare identiteitssignalen uit een URL.
Kies dit wanneer: Extraheer genormaliseerde paginametadata, previewvelden, gestructureerde gegevens en openbare identiteitssignalen uit een URL.
Categoriseer een website per industrie, inhoudstype en onderwerpen.
Kies dit wanneer: Categoriseer een website per industrie, inhoudstype en onderwerpen.
Plaats meerdere ondersteunde API-verzoeken in de wachtrij en verzamel de resultaten zonder een clientverbinding open te houden.
Kies dit wanneer: Plaats meerdere ondersteunde API-verzoeken in de wachtrij en verzamel de resultaten zonder een clientverbinding open te houden.
Je begrensde inhoud van openbare pagina’s nodig hebt met expliciete context van bestemming, modus en verwerking.
Gebruik dit niet om toegangscontroles te omzeilen, een onbeperkte site te crawlen of verzameling van elk doelwit te garanderen.
Kies de laagste voldoende verzamelmodus, bewaar bestemmingsbewijs en verrijk het resultaat alleen wanneer de workflow dat nodig heeft.