Para desenvolvedores, equipes de dados, pesquisadores e construtores de agentes
Use este fluxo para coleta limitada de páginas, extração de conteúdo, entradas de pesquisa e contexto de páginas públicas.
Escolha o modo de coleta suficiente mais simples, preserve evidências do destino e enriqueça o resultado somente quando o fluxo precisar.
Use este fluxo para coleta limitada de páginas, extração de conteúdo, entradas de pesquisa e contexto de páginas públicas.
Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.
A página pode redirecionar, exigir JavaScript, exceder o tamanho limitado de resposta ou expor apenas parte do contexto necessário ao aplicativo.
O DomScan não contorna autenticação, paywalls, controles de acesso ou restrições do alvo e não promete coletar todas as URLs públicas.
Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.
Use URL Intelligence ou Redirects quando o destino ou sinais de risco da URL precisarem ser verificados antes da coleta.
Comece com Scrape padrão, escolha novas tentativas resilientes apenas quando úteis e use renderização somente para conteúdo dependente de JavaScript.
Solicite Website Categorization ou Technology Detection após a coleta quando a tarefa posterior precisar desses sinais.
Envie a URL do artigo no modo padrão, preserve a URL final e adicione evidências de categoria somente se o aplicativo as usar.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.
Busque páginas públicas da web em HTML, Markdown ou texto, com opções síncronas e assíncronas.
Escolha quando: Busque páginas públicas da web em HTML, Markdown ou texto, com opções síncronas e assíncronas.
Extraia de uma URL metadados normalizados da página, campos de pré-visualização, dados estruturados e sinais públicos de identidade.
Escolha quando: Extraia de uma URL metadados normalizados da página, campos de pré-visualização, dados estruturados e sinais públicos de identidade.
Categorize um website por indústria, tipo de conteúdo e tópicos.
Escolha quando: Categorize um website por indústria, tipo de conteúdo e tópicos.
Coloque várias requisições compatíveis da API na fila e colete os resultados sem manter uma conexão do cliente aberta.
Escolha quando: Coloque várias requisições compatíveis da API na fila e colete os resultados sem manter uma conexão do cliente aberta.
Você precisa de conteúdo público limitado com contexto explícito de destino, modo e processamento.
Não use para contornar controles de acesso, rastrear um site sem limite ou garantir a coleta de todo alvo.
Escolha o modo de coleta suficiente mais simples, preserve evidências do destino e enriqueça o resultado somente quando o fluxo precisar.