Per sviluppatori, team dati, ricercatori e costruttori di agenti
Usa questo flusso per raccolta di pagine con limiti definiti, estrazione di contenuti, input di ricerca e contesto di pagine pubbliche.
Scegli la modalità di raccolta sufficiente più economica, conserva le prove della destinazione e arricchisci il risultato solo quando il flusso lo richiede.
Usa questo flusso per raccolta di pagine con limiti definiti, estrazione di contenuti, input di ricerca e contesto di pagine pubbliche.
Ricevi HTML, testo o markdown insieme alle prove della destinazione finale e dell’elaborazione per ogni richiesta supportata.
La pagina può reindirizzare, richiedere JavaScript, superare la dimensione di risposta definita o esporre solo parte del contesto necessario all’applicazione.
DomScan non aggira autenticazione, paywall, controlli di accesso o restrizioni della destinazione e non promette di poter raccogliere ogni URL pubblico.
Ricevi HTML, testo o markdown insieme alle prove della destinazione finale e dell’elaborazione per ogni richiesta supportata.
Usa URL Intelligence o Redirects quando prima della raccolta è necessario controllare destinazione o segnali di rischio dell’URL.
Inizia con Scrape standard, scegli il comportamento di retry resiliente solo quando è utile e usa il rendering soltanto per contenuti che dipendono da JavaScript.
Richiedi Website Categorization o Technology Detection dopo la raccolta quando l’attività successiva ha bisogno di questi segnali.
Invia l’URL dell’articolo in modalità standard, conserva l’URL finale e aggiungi prove di categoria solo se l’applicazione le utilizza.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Ricevi HTML, testo o markdown insieme alle prove della destinazione finale e dell’elaborazione per ogni richiesta supportata.
Recupera pagine web pubbliche in HTML, Markdown o testo con opzioni sincrone e asincrone.
Sceglilo quando: Recupera pagine web pubbliche in HTML, Markdown o testo con opzioni sincrone e asincrone.
Estrai da un URL metadati normalizzati della pagina, campi di anteprima, dati strutturati e segnali di identità pubblici.
Sceglilo quando: Estrai da un URL metadati normalizzati della pagina, campi di anteprima, dati strutturati e segnali di identità pubblici.
Categorizza un sito web per settore, tipo di contenuto e argomenti.
Sceglilo quando: Categorizza un sito web per settore, tipo di contenuto e argomenti.
Accoda più richieste API supportate e raccogli i risultati senza mantenere aperta una connessione client.
Sceglilo quando: Accoda più richieste API supportate e raccogli i risultati senza mantenere aperta una connessione client.
Ti servono contenuti di pagine pubbliche con limiti definiti e contesto esplicito di destinazione, modalità ed elaborazione.
Non usarlo per aggirare controlli di accesso, eseguire il crawling illimitato di un sito o garantire la raccolta di ogni destinazione.
Scegli la modalità di raccolta sufficiente più economica, conserva le prove della destinazione e arricchisci il risultato solo quando il flusso lo richiede.