Pour les développeurs, chercheurs et concepteurs d’agents
Utilisez des API ciblées lorsqu’un produit ou un flux a besoin de preuves actuelles issues d’une page publique dans une réponse structurée.
Passez d’une URL à un contenu lisible, sa destination finale, les technologies visibles, sa catégorie et les signaux associés à l’URL.
Utilisez des API ciblées lorsqu’un produit ou un flux a besoin de preuves actuelles issues d’une page publique dans une réponse structurée.
Collectez du contenu pour l’analyser, retracez une destination avant de la suivre ou enrichissez une page connue avec son contexte technologique et catégoriel.
Utilisez Scrape pour le contenu de page. Ajoutez Redirects, Technology Detection, Website Categorization ou URL Intelligence uniquement lorsque ce contexte modifie la décision.
Récupérez des pages web publiques au format HTML, Markdown ou texte, avec des options synchrones et asynchrones.
À choisir lorsque: À choisir lorsque vous avez besoin du HTML, du texte ou du Markdown d’une page publique, avec rendu ou collecte asynchrone uniquement lorsque ces options sont prises en charge et nécessaires.
Tracez la chaîne de redirection complète pour une URL.
À choisir lorsque: À choisir lorsque la destination et la chaîne de redirections comptent davantage que le contenu de la page.
Détectez la pile technologique utilisée par un site web incluant CMS, frameworks et services.
À choisir lorsque: À choisir lorsque vous avez besoin de preuves de frameworks, plateformes, outils analytiques ou technologies d’infrastructure exposés.
Catégorisez un site web par industrie, type de contenu et sujets.
À choisir lorsque: À choisir lorsque vous avez besoin d’une catégorie générale de contenu ou d’activité pour le routage, la recherche ou l’examen.
Extrayez d’une URL les métadonnées de page normalisées, les champs d’aperçu, les données structurées et les signaux d’identité publics.
À choisir lorsque: À choisir lorsque vous avez besoin d’une structure d’URL normalisée et de signaux orientés risque avant une collecte plus approfondie.
Inspectez l’URL, collectez la page en Markdown, puis ajoutez les éléments de catégorie ou de technologie nécessaires à la tâche de l’agent.
Inspectez l’URL, collectez la page en Markdown, puis ajoutez les éléments de catégorie ou de technologie nécessaires à la tâche de l’agent.
Collectez une page représentative, résolvez sa destination finale et associez son contenu aux signaux de catégorie et de technologie exposée du site.
Envoyez une URL publique à POST /v1/scrape avec une sortie Markdown. Utilisez d’abord le mode standard, puis activez le rendu uniquement si la page nécessite JavaScript.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Scrape une page de manière synchrone ou soumettez 1 à 100 URL publiques à une tâche Scrape asynchrone payante. La détection technologique prend également en charge des parcours groupés et de tâches propres au produit.
La collecte applique des limites aux redirections, à la taille des réponses, à la concurrence et aux modes de traitement. Elle ne garantit pas l’accès à toutes les pages.
Choisissez le mode de collecte suffisant le plus léger, conservez les éléments de preuve de destination et enrichissez le résultat uniquement lorsque le flux en a besoin.
Permettez à un agent de collecter une page, de comprendre le domaine associé et de demander des preuves plus approfondies uniquement lorsque la tâche l’exige.
Collectez des pages publiques et reliez-les au contexte du domaine, de l’entreprise, de la technologie, du DNS et de l’infrastructure.
Consultez les cinq produits de données Web ou effectuez votre première requête Scrape depuis la documentation.