Solução para coleta de dados

Colete páginas públicas da Web em um formato que seu aplicativo possa usar

Escolha o modo de coleta suficiente mais simples, preserve evidências do destino e enriqueça o resultado somente quando o fluxo precisar.

Para desenvolvedores, equipes de dados, pesquisadores e construtores de agentes

Use este fluxo para coleta limitada de páginas, extração de conteúdo, entradas de pesquisa e contexto de páginas públicas.

Conteúdo de página utilizável com contexto de coleta

Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.

Uma URL sozinha não é um registro de conteúdo confiável

A página pode redirecionar, exigir JavaScript, exceder o tamanho limitado de resposta ou expor apenas parte do contexto necessário ao aplicativo.

A coleta é limitada e o acesso não é garantido

O DomScan não contorna autenticação, paywalls, controles de acesso ou restrições do alvo e não promete coletar todas as URLs públicas.

Fluxo de trabalho

Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.

Inspecionar e normalizar a URL de destino

Use URL Intelligence ou Redirects quando o destino ou sinais de risco da URL precisarem ser verificados antes da coleta.

Coletar com o modo suficiente mais simples

Comece com Scrape padrão, escolha novas tentativas resilientes apenas quando úteis e use renderização somente para conteúdo dependente de JavaScript.

Adicionar contexto estruturado quando ele mudar a decisão

Solicite Website Categorization ou Technology Detection após a coleta quando a tarefa posterior precisar desses sinais.

Coletar um artigo público em Markdown

Envie a URL do artigo no modo padrão, preserve a URL final e adicione evidências de categoria somente se o aplicativo as usar.

Pedido de Exemplo
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
Resposta de Exemplo
{
  "data": {
    "url": "https://example.com",
    "outcome": "success",
    "content": "# Example Domain",
    "truncated": false
  },
  "billing": { "credits_charged": 1, "credits_refunded": 0 }
}

Produtos neste fluxo de trabalho

Receba HTML, texto ou Markdown, além de evidências do destino final e do processamento para cada solicitação compatível.

Web Scraping

Busque páginas públicas da web em HTML, Markdown ou texto, com opções síncronas e assíncronas.

Escolha quando: Busque páginas públicas da web em HTML, Markdown ou texto, com opções síncronas e assíncronas.

Entradas
URL
Resultados
Coletar
Créditos
0-20
SíncronaAssíncronaRESTMCPSDK

Inteligência de URL unificada

Extraia de uma URL metadados normalizados da página, campos de pré-visualização, dados estruturados e sinais públicos de identidade.

Escolha quando: Extraia de uma URL metadados normalizados da página, campos de pré-visualização, dados estruturados e sinais públicos de identidade.

Entradas
URL
Resultados
Coletar, Enriquecer
Créditos
2
SíncronaEm loteRESTMCPSDK

Categorização de Website

Categorize um website por indústria, tipo de conteúdo e tópicos.

Escolha quando: Categorize um website por indústria, tipo de conteúdo e tópicos.

Entradas
URL, Domínio
Resultados
Enriquecer, Avaliar
Créditos
0-3
SíncronaEm loteRESTMCPSDKFerramenta interativa

Lotes assíncronos de API

Coloque várias requisições compatíveis da API na fila e colete os resultados sem manter uma conexão do cliente aberta.

Escolha quando: Coloque várias requisições compatíveis da API na fila e colete os resultados sem manter uma conexão do cliente aberta.

Entradas
Domínio, URL, Endereço de e-mail
Resultados
Automatizar
Créditos
0
AssíncronaRESTMCPSDK

Escolha este fluxo quando

Escolha quando

Você precisa de conteúdo público limitado com contexto explícito de destino, modo e processamento.

Não indicado para

Não use para contornar controles de acesso, rastrear um site sem limite ou garantir a coleta de todo alvo.

Suítes de produtos relacionadas

Conteúdo de página utilizável com contexto de coleta

Escolha o modo de coleta suficiente mais simples, preserve evidências do destino e enriqueça o resultado somente quando o fluxo precisar.