Données Web

Collectez du contenu Web public avec le contexte nécessaire pour l’exploiter

Passez d’une URL à un contenu lisible, sa destination finale, les technologies visibles, sa catégorie et les signaux associés à l’URL.

Pour les développeurs, chercheurs et concepteurs d’agents

Utilisez des API ciblées lorsqu’un produit ou un flux a besoin de preuves actuelles issues d’une page publique dans une réponse structurée.

Commencez par le résultat dont vous avez besoin

Collectez du contenu pour l’analyser, retracez une destination avant de la suivre ou enrichissez une page connue avec son contexte technologique et catégoriel.

Entrées

URLDomaine

Résultats

CollecterÉvaluerDécouvrirEnrichir

Choisissez le produit le plus ciblé qui répond à la question

Utilisez Scrape pour le contenu de page. Ajoutez Redirects, Technology Detection, Website Categorization ou URL Intelligence uniquement lorsque ce contexte modifie la décision.

Web scraping

Récupérez des pages web publiques au format HTML, Markdown ou texte, avec des options synchrones et asynchrones.

À choisir lorsque: À choisir lorsque vous avez besoin du HTML, du texte ou du Markdown d’une page publique, avec rendu ou collecte asynchrone uniquement lorsque ces options sont prises en charge et nécessaires.

Entrées
URL
Résultats
Collecter
Crédits
0-20
SynchroneAsynchroneRESTMCPSDK

Chaîne de Redirection

Tracez la chaîne de redirection complète pour une URL.

À choisir lorsque: À choisir lorsque la destination et la chaîne de redirections comptent davantage que le contenu de la page.

Entrées
URL, Domaine
Résultats
Collecter, Évaluer
Crédits
2
SynchroneRESTMCPSDKOutil interactif

Détection de Pile Technologique

Détectez la pile technologique utilisée par un site web incluant CMS, frameworks et services.

À choisir lorsque: À choisir lorsque vous avez besoin de preuves de frameworks, plateformes, outils analytiques ou technologies d’infrastructure exposés.

Entrées
URL, Domaine
Résultats
Découvrir, Enrichir, Évaluer
Crédits
0-9
SynchronePar lotsAsynchroneRESTMCPSDKOutil interactif

Catégorisation de Site Web

Catégorisez un site web par industrie, type de contenu et sujets.

À choisir lorsque: À choisir lorsque vous avez besoin d’une catégorie générale de contenu ou d’activité pour le routage, la recherche ou l’examen.

Entrées
URL, Domaine
Résultats
Enrichir, Évaluer
Crédits
0-3
SynchronePar lotsRESTMCPSDKOutil interactif

Intelligence URL unifiée

Extrayez d’une URL les métadonnées de page normalisées, les champs d’aperçu, les données structurées et les signaux d’identité publics.

À choisir lorsque: À choisir lorsque vous avez besoin d’une structure d’URL normalisée et de signaux orientés risque avant une collecte plus approfondie.

Entrées
URL
Résultats
Collecter, Enrichir
Crédits
2
SynchronePar lotsRESTMCPSDK

Flux de travail

Inspectez l’URL, collectez la page en Markdown, puis ajoutez les éléments de catégorie ou de technologie nécessaires à la tâche de l’agent.

De la page au contexte prêt pour un agent

Inspectez l’URL, collectez la page en Markdown, puis ajoutez les éléments de catégorie ou de technologie nécessaires à la tâche de l’agent.

Instantané de recherche d’un site Web

Collectez une page représentative, résolvez sa destination finale et associez son contenu aux signaux de catégorie et de technologie exposée du site.

Collecter une page publique en Markdown

Envoyez une URL publique à POST /v1/scrape avec une sortie Markdown. Utilisez d’abord le mode standard, puis activez le rendu uniquement si la page nécessite JavaScript.

Exemple de Requête
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
Exemple de Réponse
{
  "data": {
    "url": "https://example.com",
    "outcome": "success",
    "content": "# Example Domain",
    "truncated": false
  },
  "billing": { "credits_charged": 1, "credits_refunded": 0 }
}

Le synchrone d’abord, les tâches lorsque la charge l’exige

Scrape une page de manière synchrone ou soumettez 1 à 100 URL publiques à une tâche Scrape asynchrone payante. La détection technologique prend également en charge des parcours groupés et de tâches propres au produit.

SynchronePar lotsAsynchroneRESTMCPSDKOutil interactif

Collecte encadrée de pages publiques

La collecte applique des limites aux redirections, à la taille des réponses, à la concurrence et aux modes de traitement. Elle ne garantit pas l’accès à toutes les pages.

Commencez par une page, puis ajoutez seulement le contexte nécessaire

Consultez les cinq produits de données Web ou effectuez votre première requête Scrape depuis la documentation.