Para desarrolladores, equipos de datos, investigadores y constructores de agentes
Usa este flujo para recopilar páginas acotadas, extraer contenido, obtener entradas de investigación y añadir contexto de páginas públicas.
Elige el modo de recopilación suficiente más sencillo, conserva evidencias del destino y enriquece el resultado solo cuando el flujo lo necesite.
Usa este flujo para recopilar páginas acotadas, extraer contenido, obtener entradas de investigación y añadir contexto de páginas públicas.
Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.
La página puede redirigir, requerir JavaScript, superar el tamaño de respuesta acotado o exponer solo parte del contexto que necesita tu aplicación.
DomScan no sortea autenticación, muros de pago, controles de acceso ni restricciones del destino y no promete recopilar todas las URL públicas.
Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.
Usa URL Intelligence o Redirects cuando debas comprobar el destino o las señales de riesgo de la URL antes de recopilarla.
Empieza con Scrape estándar, elige reintentos resistentes solo cuando sean útiles y usa el renderizado únicamente para contenido que dependa de JavaScript.
Solicita Website Categorization o Technology Detection después de recopilar cuando la tarea posterior necesite esas señales.
Envía la URL del artículo en modo estándar, conserva la URL final y añade evidencias de categoría solo si la aplicación las utiliza.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Recibe HTML, texto o markdown junto con evidencias del destino final y del procesamiento de cada solicitud compatible.
Obtén páginas web públicas en HTML, Markdown o texto, con opciones síncronas y asíncronas.
Elige esto cuando: Obtén páginas web públicas en HTML, Markdown o texto, con opciones síncronas y asíncronas.
Extrae de una URL metadatos normalizados de la página, campos de vista previa, datos estructurados y señales públicas de identidad.
Elige esto cuando: Extrae de una URL metadatos normalizados de la página, campos de vista previa, datos estructurados y señales públicas de identidad.
Categoriza un sitio web por industria, tipo de contenido y temas.
Elige esto cuando: Categoriza un sitio web por industria, tipo de contenido y temas.
Pon en cola varias solicitudes compatibles de la API y recopila sus resultados sin mantener abierta una conexión del cliente.
Elige esto cuando: Pon en cola varias solicitudes compatibles de la API y recopila sus resultados sin mantener abierta una conexión del cliente.
Necesites contenido de páginas públicas acotado con destino, modo y contexto de procesamiento explícitos.
No lo uses para sortear controles de acceso, rastrear un sitio sin límites ni garantizar la recopilación de todos los destinos.
Elige el modo de recopilación suficiente más sencillo, conserva evidencias del destino y enriquece el resultado solo cuando el flujo lo necesite.