Zum Testen klicken
Warten...

Crawlen Sie viele Seiten.
Rufen Sie Inhalte bei Bedarf ab.

Der Crawl-Endpunkt entdeckt und verarbeitet Unterseiten nach Ihren Regeln — anschließend rufen Sie HTML oder Markdown pro Seite über retrieve ab.

Thank you! Your submission has been received!
Oops! Something went wrong while submitting the form.

Vertraut von den besten Startups Startups weltweit

Gebaut für Mehrseiten-Jobs

Die /v1/crawls-API liegt zwischen einmaligen Scrapes und riesigen Batch-URL-Listen.

  • Begrenzte Exploration

    Steuern Sie depth und max_pages, damit Crawls vorhersehbar bleiben.

  • Webhooks

    Optionales webhook_url, wenn der Crawl abgeschlossen ist.

  • Cursor-Pagination

    Streamen Sie Seiten, während der Crawl läuft oder nach Abschluss.

  • Retrieve-Pipeline

    Kombinieren Sie Crawls mit /v1/retrieve für Markdown-, HTML- oder JSON-Formate.

Crawl starten. Abfragen. Seiten auflisten.

Nutzen Sie Webhooks für Abschlusssignale; paginieren Sie Seiten mit cursor und limit.

Crawlen Sie alle Unterseiten

1# pip install olostep
2from olostep import Olostep
3
4client = Olostep(api_key="YOUR_REAL_KEY")
5
6crawl = client.crawls.create(
7    start_url="https://olostep.com",
8    max_pages=100,
9    include_urls=["/**"],
10    exclude_urls=["/collections/**"],
11    include_external=False,
12)
13
14print(crawl.id, crawl.status)
15
16# Wait for completion and iterate pages
17for page in crawl.pages():
18    print(page.url)
19    content = page.retrieve(["markdown"])
20    print(content.markdown_content[:200])
1// npm i olostep
2import Olostep from 'olostep'
3
4const client = new Olostep({ apiKey: 'YOUR_REAL_KEY' })
5
6const crawl = await client.crawls.create({
7  url: 'https://olostep.com',
8  maxPages: 100,
9  includeUrls: ['/**'],
10  excludeUrls: ['/collections/**'],
11  includeExternal: false,
12})
13
14console.log(crawl.id, crawl.status)
15
16// Wait for completion and iterate pages
17for await (const page of crawl.pages()) {
18  console.log(page.url)
19  const content = await client.retrieve({ retrieveId: page.retrieve_id, formats: ['markdown'] })
20  console.log(content.markdown_content.slice(0, 200))
21}
1# Start crawl
2curl -s -X POST "https://api.olostep.com/v1/crawls" \
3  -H "Authorization: Bearer <YOUR_API_KEY>" \
4  -H "Content-Type: application/json" \
5  -d '{
6    "start_url": "https://olostep.com",
7    "max_pages": 100,
8    "include_urls": ["/**"],
9    "exclude_urls": ["/collections/**"],
10    "include_external": false
11  }'
12
13# Check status (replace <CRAWL_ID>)
14curl -s "https://api.olostep.com/v1/crawls/<CRAWL_ID>" \
15  -H "Authorization: Bearer <YOUR_API_KEY>"
16
17# Get pages (replace <CRAWL_ID>)
18curl -s "https://api.olostep.com/v1/crawls/<CRAWL_ID>/pages" \
19  -H "Authorization: Bearer <YOUR_API_KEY>"
20
21# Retrieve content (replace <RETRIEVE_ID>)
22curl -s -G "https://api.olostep.com/v1/retrieve" \
23  -H "Authorization: Bearer <YOUR_API_KEY>" \
24  --data-urlencode "retrieve_id=<RETRIEVE_ID>" \
25  --data-urlencode "formats=markdown"

Was Sie bauen können

Treiben Sie Enrichment, Monitoring und KI-Workflows mit Live-Webseiten an.

  • Dokumentations-Spiegel

    Rufen Sie jede Docs-Seite für Offline-Suche oder RAG ab.

  • E-Commerce-Kataloge

    Crawlen Sie Produktbereiche mit include-Mustern.

  • Compliance-Archive

    Erstellen Sie Snapshots vieler Seiten einer Domain mit Audit-Metadaten.

Weitere Use Cases entdecken

Vertraut von großartigen Teams, die die Zukunft der KI gestalten

  • Michelle Julia
    Mitgründer & CEO Aurium

    Olostep ist das Beste!!! Wir haben komplette Datenpipelines mit nur einem Prompt automatisiert

  • Richard He
    Mitgründer & CEO Openmart

    Olostep ist zur Standard-Web-Layer-Infrastruktur unseres Unternehmens geworden

  • Max Brodeur-Urbas
    Mitgründer & CEO Gumloop

    Olostep funktioniert wie ein Zauber! Und Ihr Kundenservice ist hervorragend

  • Rob Hayes
    Mitgründer Merchkit

    Mit Olostep können wir jede Website in eine API verwandeln. Tolles Produkt, tolle Leute

  • Brandon Cohen
    Mitgründer & CTO CivilGrid

    Ich kann Olostep sehr empfehlen, ein großartiges Produkt!

  • Mitgründer & CEO Gedd.it

    Wir verifizieren Gutscheincodes im großen Maßstab. Wir lieben Olostep. Es funktioniert mit jedem E-Commerce

  • Trevor West
    Mitgründer & CEO Podqi

    Olostep ist die beste API, um Daten aus dem Web zu suchen, zu extrahieren und zu strukturieren. Wir sind gerne Kunden

  • Rida Naveed
    Mitgründer Zecento

    Wir nutzen /batches in Kombination mit Parsern, und es ist erstaunlich, wie wir strukturierte Daten in großem Maßstab erhalten

  • Kieran V.
    Growth PlotsEvents

    Mit Olostep konnten wir Eventdaten im gesamten Web suchen und strukturieren

  • Paul Mit
    Gründer Foundbase

    Zuverlässige und kosteneffiziente API für die Arbeit mit Daten. Glückwunsch zum coolen Produkt

Starten Sie das Crawlen mit Olostep

Erhalten Sie saubere Daten für Ihre KI von jeder Website mit Olostep
Die kosteneffizienteste API. Für Skalierung gebaut

Sind Sie ein KI-Agent? Hier starten

Häufig gestellte Fragen

Produkt & Funktionen
  • Wofür ist der Crawl-Endpunkt gedacht?

    Er durchläuft eine Website (innerhalb Ihrer Limits) und liefert Seiten-Datensätze, die Sie später mit /v1/retrieve abrufen können — ideal für Mehrseiten-Extraktion, ohne jede URL selbst orchestrieren zu müssen.

  • Wie erhalte ich den Seiteninhalt?

    Listen Sie Seiten über /v1/crawls/{id}/pages auf und rufen Sie dann /v1/retrieve mit der retrieve_id jeder Seite auf. Bevorzugen Sie retrieve gegenüber veralteten Inline-Content-Feldern auf Seiten.

Nutzung & Automatisierung
  • Kann ich filtern, welche URLs gecrawlt werden?

    Ja. Verwenden Sie include_urls- und exclude_urls-Globs, search_query, top_n und verwandte Parameter wie dokumentiert.

Preise & Tarife
  • Wie viel kostet das Crawlen?

    Crawl wird pro gecrawlter Seite abgerechnet (aktuelle Preise siehe Docs).