Para desarrolladores, investigadores y constructores de agentes
Usa APIs específicas cuando un producto o flujo necesite evidencias actuales de una página pública en una respuesta estructurada.
Pasa de una URL a contenido legible, su destino final, tecnologías visibles, categoría y señales de nivel de URL.
Usa APIs específicas cuando un producto o flujo necesite evidencias actuales de una página pública en una respuesta estructurada.
Recopila contenido para analizarlo, sigue un destino antes de acceder a él o enriquece una página conocida con contexto tecnológico y categórico.
Usa Scrape para el contenido de la página. Añade Redirects, Technology Detection, Website Categorization o URL Intelligence solo cuando ese contexto cambie la decisión.
Obtén páginas web públicas en HTML, Markdown o texto, con opciones síncronas y asíncronas.
Elige esto cuando: Elige esto cuando necesites HTML, texto o markdown de una página pública, con renderizado o recopilación asíncrona solo cuando sean compatibles y necesarios.
Rastrea la cadena de redireccionamiento completa para una URL.
Elige esto cuando: Elige esto cuando importen más el destino y la cadena de redirecciones que el cuerpo de la página.
Detecta la pila de tecnología utilizada por un sitio web incluyendo CMS, frameworks y servicios.
Elige esto cuando: Elige esto cuando necesites evidencias de frameworks, plataformas, analítica o tecnologías de infraestructura expuestas.
Categoriza un sitio web por industria, tipo de contenido y temas.
Elige esto cuando: Elige esto cuando necesites una categoría amplia de contenido o negocio para enrutar, investigar o revisar.
Extrae de una URL metadatos normalizados de la página, campos de vista previa, datos estructurados y señales públicas de identidad.
Elige esto cuando: Elige esto cuando necesites una estructura de URL normalizada y señales de URL orientadas al riesgo antes de recopilar más datos.
Inspecciona la URL, recopila la página como markdown y añade las evidencias de categoría o tecnología que requiera la tarea del agente.
Inspecciona la URL, recopila la página como markdown y añade las evidencias de categoría o tecnología que requiera la tarea del agente.
Recopila una página representativa, resuelve su destino final y combina el contenido con señales de categoría y tecnologías expuestas.
Envía una URL pública a POST /v1/scrape con salida markdown. Usa primero el modo estándar y selecciona el renderizado solo cuando la página necesite JavaScript.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Analiza una página de forma síncrona o envía de 1 a 100 URL públicas a un trabajo de scraping asíncrono de pago. Technology Detection también admite rutas de lotes y trabajos específicas del producto.
La recopilación utiliza redirecciones, tamaños de respuesta, concurrencia y modos de procesamiento acotados. No promete acceso a todas las páginas.
Elige el modo de recopilación suficiente más sencillo, conserva evidencias del destino y enriquece el resultado solo cuando el flujo lo necesite.
Permite que un agente recopile una página, comprenda el dominio que hay detrás y solicite evidencias más profundas solo cuando la tarea lo requiera.
Recopila páginas públicas y relaciónalas con el contexto de dominio, empresa, tecnología, DNS e infraestructura.
Revisa los cinco productos de Datos web o realiza tu primera solicitud de Scrape desde la documentación.