Solución para recopilar datos

Recopila páginas web públicas en un formato que tu aplicación pueda utilizar

Elige el modo de recopilación suficiente más sencillo, conserva evidencias del destino y enriquece el resultado solo cuando el flujo lo necesite.

Para desarrolladores, equipos de datos, investigadores y constructores de agentes

Usa este flujo para recopilar páginas acotadas, extraer contenido, obtener entradas de investigación y añadir contexto de páginas públicas.

Contenido de página utilizable con contexto de recopilación

Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.

Una URL por sí sola no es un registro de contenido fiable

La página puede redirigir, requerir JavaScript, superar el tamaño de respuesta acotado o exponer solo parte del contexto que necesita tu aplicación.

La recopilación es acotada y el acceso no está garantizado

DomScan no sortea autenticación, muros de pago, controles de acceso ni restricciones del destino y no promete recopilar todas las URL públicas.

Flujo de trabajo

Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.

Inspecciona y normaliza la URL de destino

Usa URL Intelligence o Redirects cuando debas comprobar el destino o las señales de riesgo de la URL antes de recopilarla.

Recopila con el modo suficiente más sencillo

Empieza con Scrape estándar, elige reintentos resistentes solo cuando sean útiles y usa el renderizado únicamente para contenido que dependa de JavaScript.

Añade contexto estructurado cuando cambie la decisión

Solicita Website Categorization o Technology Detection después de recopilar cuando la tarea posterior necesite esas señales.

Recopilar un artículo público como markdown

Envía la URL del artículo en modo estándar, conserva la URL final y añade evidencias de categoría solo si la aplicación las utiliza.

Solicitud de ejemplo
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
Respuesta de ejemplo
{
  "data": {
    "url": "https://example.com",
    "outcome": "success",
    "content": "# Example Domain",
    "truncated": false
  },
  "billing": { "credits_charged": 1, "credits_refunded": 0 }
}

Productos de este flujo de trabajo

Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.

Web Scraping

Obtén páginas web públicas en HTML, Markdown o texto, con opciones síncronas y asíncronas.

Elige esto cuando: Obtén páginas web públicas en HTML, Markdown o texto, con opciones síncronas y asíncronas.

Entradas
URL
Resultados
Recopilar
Créditos
0-20
SíncronaAsíncronaRESTMCPSDK

Inteligencia de URL unificada

Extrae de una URL metadatos normalizados de la página, campos de vista previa, datos estructurados y señales públicas de identidad.

Elige esto cuando: Extrae de una URL metadatos normalizados de la página, campos de vista previa, datos estructurados y señales públicas de identidad.

Entradas
URL
Resultados
Recopilar, Enriquecer
Créditos
2
SíncronaPor lotesRESTMCPSDK

Categorización de Sitio Web

Categoriza un sitio web por industria, tipo de contenido y temas.

Elige esto cuando: Categoriza un sitio web por industria, tipo de contenido y temas.

Entradas
URL, Dominio
Resultados
Enriquecer, Evaluar
Créditos
0-3
SíncronaPor lotesRESTMCPSDKHerramienta interactiva

Lotes asíncronos de API

Pon en cola varias solicitudes compatibles de la API y recopila sus resultados sin mantener abierta una conexión del cliente.

Elige esto cuando: Pon en cola varias solicitudes compatibles de la API y recopila sus resultados sin mantener abierta una conexión del cliente.

Entradas
Dominio, URL, Dirección de correo electrónico
Resultados
Automatizar
Créditos
0
AsíncronaRESTMCPSDK

Elige este flujo cuando

Elige esto cuando

Necesites contenido de páginas públicas acotado con destino, modo y contexto de procesamiento explícitos.

No es para

No lo uses para sortear controles de acceso, rastrear un sitio sin límites ni garantizar la recopilación de todos los destinos.

Suites de productos relacionadas

Contenido de página utilizable con contexto de recopilación

Elige el modo de recopilación suficiente más sencillo, conserva evidencias del destino y enriquece el resultado solo cuando el flujo lo necesite.