Olostep Scrape-Endpoint

Verwandle jede URL in saubere, LLM-taugliche Daten.

Der Scrape-Endpoint extrahiert Markdown, HTML, Text, JSON, Screenshots und mehr — in Echtzeit.

So funktioniert's

Sende (POST) url_to_scrape und formats.

Olostep lädt die Seite (mit optionalen Aktionen oder Parsern).

Lies strukturierte Felder aus dem scrape-Objekt in der Antwort aus.

Das Vertrauen von Teams weltweit

Merchkit
Podqi
Khoj
Finny AI
Contents
Athena HQ
CivilGrid
GumLoop
Plots
Uman
Verisave
Relay
OpenMart
Profound
Centralize
Use Bear
Merchkit
Podqi
Khoj
Finny AI
Contents
Athena HQ
CivilGrid
GumLoop
Plots
Uman
Verisave
Relay
OpenMart
Profound
Centralize
Use Bear
Merchkit
Podqi
Khoj
Finny AI
Contents
Athena HQ
CivilGrid
GumLoop
Plots
Uman
Verisave
Relay
OpenMart
Profound
Centralize
Use Bear
Merchkit
Podqi
Khoj
Finny AI
Contents
Athena HQ
CivilGrid
GumLoop
Plots
Uman
Verisave
Relay
OpenMart
Profound
Centralize
Use Bear

Von der URL zum extrahierten Inhalt

Ein einziger HTTP-Aufruf — ohne eine eigene Headless-Browser-Flotte betreiben zu müssen.

  • Step 1

    Sende eine URL und Formate

    Sende (POST) die gewünschte Seite zusammen mit formats: markdown, html, text, json, screenshot und mehr.

  • Step 2

    Olostep rendert die Seite

    Verarbeitet dynamische Seiten, Aktionen, PDFs sowie optionale Parser oder LLM-Extraktion für strukturiertes JSON.

  • Step 3

    Erhalte sauberen Inhalt zurück

    Erhalte markdown_content, html_content, json_content, gehostete URLs, links_on_page und Metadaten.

POST /v1/scrapes

{
  "url_to_scrape": "https://en.wikipedia.org/wiki/Alexander_the_Great",
  "formats": ["markdown", "html"]
}

Für Scraping in Produktionsumgebungen entwickelt

Die /v1/scrapes-API ist für Apps ausgelegt, die zuverlässige Seitenextraktion im großen Maßstab benötigen.

  • Mehrere Formate

    Fordere markdown, html, text, json, raw_pdf oder screenshot in einem einzigen Aufruf an.

  • Parser & LLM-Extraktion

    Nutze vorgefertigte Parser für beliebte Websites oder definiere ein Schema für LLM-gestützte Extraktion.

  • Gehostete Assets

    Erhalte gehostete URLs für große Payloads zusätzlich zu den Inline-Inhaltsfeldern.

  • Entwicklerfreundlich

    Ein einziger POST mit url_to_scrape und formats — in wenigen Minuten integriert.

Was du damit bauen kannst

Treibe Anreicherung, Monitoring und KI-Workflows mit Live-Webseiten an.

  • RAG & Wissensdatenbanken

    Zerlege sauberes Markdown oder JSON in Embeddings für Suche und Q&A.

  • Preis- und Katalogüberwachung

    Scrape Produktseiten nach Zeitplan und vergleiche strukturierte Felder.

  • Leads & Anreicherung

    Extrahiere strukturierte Kontakt- oder Unternehmensdaten von Landingpages.

Ein API-Aufruf. Echter Inhalt.

Scrape eine Seite. Wähle deine Formate.

Erforderlich: url_to_scrape und formats. Füge parsers oder llm_extract hinzu, wenn du strukturiertes JSON benötigst.

AnfragePOST /v1/scrapes
{
  "url_to_scrape": "https://en.wikipedia.org/wiki/Alexander_the_Great",
  "formats": ["markdown", "html"]
}
Antwort200 OK
{
  "id": "scrape_…",
  "object": "scrape",
  "url_to_scrape": "https://en.wikipedia.org/wiki/…",
  "result": {
    "markdown_content": "## Alexander the Great…",
    "html_content": "<html …>",
    "json_content": null,
    "page_metadata": { "status_code": 200, "title": "…" }
  }
}

Häufig gestellte Fragen

Produkt & Funktionen

  • Er verwandelt jede öffentliche URL in Daten, die du an LLMs oder Pipelines weitergeben kannst: Markdown, HTML, Text, Screenshots oder strukturiertes JSON über Parser oder llm_extract.

  • Verwende formats: ["json"] mit einer Parser-ID oder llm_extract mit einem JSON-Schema und/oder einem Prompt. Beispiele findest du in der Scrape-Dokumentation.

Nutzung & Automatisierung

  • Ja. Olostep kann dynamische Seiten rendern und unterstützt Aktionen (wait, click, fill_input, scroll) vor der Extraktion.

  • Ein Standard-Scrape kostet 1 Credit. Parser variieren (meist 1–5 Credits). LLM-Extraktion kostet 20 Credits pro Anfrage. Neue Konten erhalten kostenlose Credits zum Testen.

Preise & Tarife

  • Ja. Verwende Parameter wie remove_css_selectors und andere Scrape-Optionen, um dich auf den benötigten Inhalt zu konzentrieren.

Starte das Scraping mit Olostep

500 kostenlose Credits zum Testen
Keine Kreditkarte erforderlich.

Scrape Endpoint | URL zu Markdown, HTML & JSON | Olostep