面向开发者、数据团队、研究人员和智能体构建者
将此工作流用于有范围限制的页面收集、内容提取、研究输入和公开页面上下文。
将此工作流用于有范围限制的页面收集、内容提取、研究输入和公开页面上下文。
为每个支持的请求接收 HTML、文本或 Markdown,以及最终目标和处理证据。
页面可能重定向、需要 JavaScript、超过有范围限制的响应大小,或只暴露应用所需上下文的一部分。
DomScan 不绕过身份验证、付费墙、访问控制或目标限制,也不承诺能够收集每个公开 URL。
为每个支持的请求接收 HTML、文本或 Markdown,以及最终目标和处理证据。
如果收集前需要检查目标或 URL 风险信号,使用 URL Intelligence 或 Redirects。
从 standard Scrape 开始,仅在有帮助时选择弹性重试,并只对依赖 JavaScript 的内容使用渲染。
当下游任务需要这些信号时,在收集后请求 Website Categorization 或 Technology Detection。
以 standard 模式提交文章 URL,保留最终 URL,并仅在应用使用时添加类别证据。
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
为每个支持的请求接收 HTML、文本或 Markdown,以及最终目标和处理证据。
以 HTML、Markdown 或文本形式获取公开网页,支持同步和异步选项。
适用场景: 以 HTML、Markdown 或文本形式获取公开网页,支持同步和异步选项。
从 URL 提取规范化页面元数据、预览字段、结构化数据和公开身份信号。
适用场景: 从 URL 提取规范化页面元数据、预览字段、结构化数据和公开身份信号。
按行业、内容类型和主题对网站进行分类。
适用场景: 按行业、内容类型和主题对网站进行分类。
将多个受支持的 API 请求加入队列,无需保持客户端连接即可收集结果。
适用场景: 将多个受支持的 API 请求加入队列,无需保持客户端连接即可收集结果。