Für Entwickler, Datenteams, Forscher und Agentenbauer
Nutzen Sie diesen Workflow für begrenzte Seitensammlung, Inhaltsextraktion, Rechercheeingaben und Kontext öffentlicher Seiten.
Wählen Sie den niedrigsten ausreichenden Sammlungsmodus, bewahren Sie Zielbelege und reichern Sie das Ergebnis nur bei Bedarf an.
Nutzen Sie diesen Workflow für begrenzte Seitensammlung, Inhaltsextraktion, Rechercheeingaben und Kontext öffentlicher Seiten.
Erhalten Sie HTML, Text oder Markdown sowie Belege zum endgültigen Ziel und zur Verarbeitung jeder unterstützten Anfrage.
Die Seite kann weiterleiten, JavaScript benötigen, die begrenzte Antwortgröße überschreiten oder nur einen Teil des benötigten Kontexts liefern.
DomScan umgeht keine Authentifizierung, Bezahlschranken, Zugriffskontrollen oder Zielbeschränkungen und verspricht nicht die Sammlung jeder öffentlichen URL.
Erhalten Sie HTML, Text oder Markdown sowie Belege zum endgültigen Ziel und zur Verarbeitung jeder unterstützten Anfrage.
Nutzen Sie URL Intelligence oder Redirects, wenn Ziel- oder URL-Risikosignale vor der Sammlung geprüft werden sollen.
Beginnen Sie mit Standard-Scrape, wählen Sie robuste Wiederholungen nur bei Nutzen und verwenden Sie Rendering nur für JavaScript-abhängige Inhalte.
Fordern Sie Website Categorization oder Technology Detection nach der Sammlung an, wenn die nachgelagerte Aufgabe diese Signale benötigt.
Übermitteln Sie die Artikel-URL im Standardmodus, bewahren Sie die endgültige URL und ergänzen Sie Kategoriebelege nur bei Nutzung durch die Anwendung.
curl -X POST "https://domscan.net/v1/scrape" -H "X-API-Key: $DOMSCAN_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","output":"markdown"}'
{
"data": {
"url": "https://example.com",
"outcome": "success",
"content": "# Example Domain",
"truncated": false
},
"billing": { "credits_charged": 1, "credits_refunded": 0 }
}
Erhalten Sie HTML, Text oder Markdown sowie Belege zum endgültigen Ziel und zur Verarbeitung jeder unterstützten Anfrage.
Rufe öffentliche Webseiten als HTML, Markdown oder Text ab, mit synchronen und asynchronen Optionen.
Wählen Sie dies, wenn: Rufe öffentliche Webseiten als HTML, Markdown oder Text ab, mit synchronen und asynchronen Optionen.
Extrahieren Sie normalisierte Seitenmetadaten, Vorschaufelder, strukturierte Daten und öffentliche Identitätssignale aus einer URL.
Wählen Sie dies, wenn: Extrahieren Sie normalisierte Seitenmetadaten, Vorschaufelder, strukturierte Daten und öffentliche Identitätssignale aus einer URL.
Kategorisieren Sie eine Website nach Branche, Inhaltstyp und Themen.
Wählen Sie dies, wenn: Kategorisieren Sie eine Website nach Branche, Inhaltstyp und Themen.
Stellen Sie mehrere unterstützte API-Anfragen in eine Warteschlange und rufen Sie die Ergebnisse ab, ohne eine Clientverbindung offen zu halten.
Wählen Sie dies, wenn: Stellen Sie mehrere unterstützte API-Anfragen in eine Warteschlange und rufen Sie die Ergebnisse ab, ohne eine Clientverbindung offen zu halten.
Sie begrenzte Inhalte öffentlicher Seiten mit explizitem Ziel-, Modus- und Verarbeitungskontext benötigen.
Verwenden Sie ihn nicht zum Umgehen von Zugriffskontrollen, für unbegrenztes Crawling oder als Garantie für jede Zielseite.
Wählen Sie den niedrigsten ausreichenden Sammlungsmodus, bewahren Sie Zielbelege und reichern Sie das Ergebnis nur bei Bedarf an.