Web-Daten-API für KI-Anwendungen

Jede Website als sauberes Markdown und strukturierte Daten.

Ragfeed rendert Seiten mit echtem Browser, entfernt Navigation, Werbung und Cookie-Banner und liefert Markdown, HTML, Screenshots oder JSON nach deinem Schema. Einzelne Seiten, ganze Websites, Suche und KI-Extraktion über eine API.

curl -X POST https://api.ragfeed.de/v2/scrape \
  -H "Authorization: Bearer sk-..." \
  -H "Content-Type: application/json" \
  -d '{"url": "https://example.com", "formats": ["markdown"]}'

Alles, was ein KI-Agent vom Web braucht

Fünf Endpunkte decken Einzelseiten, ganze Websites und die offene Websuche ab.

POST /v2/scrape

Scrape

Eine URL wird zu Markdown, HTML, Links, Bildern, Screenshot oder JSON. JavaScript-Seiten werden im Browser gerendert, PDFs als Text geliefert.

POST /v2/crawl

Crawl

Ganze Websites inklusive Sitemap, mit Pfadfiltern, Tiefenlimit, robots.txt-Beachtung und Webhooks pro Seite.

POST /v2/map

Map

In Sekunden alle URLs einer Domain. Mit Suchbegriff bekommst du sie nach Relevanz sortiert.

POST /v2/search

Search

Websuche mit optional direkt gescrapten Ergebnissen, auch für News und Bilder.

POST /v2/extract

Extract

Strukturierte Daten nach deinem JSON-Schema, auch über viele Seiten hinweg (example.com/*).

actions · screenshot · pdf

Browser-Aktionen

Klicken, Tippen, Scrollen, Warten und JavaScript ausführen, bevor der Inhalt erfasst wird.

POST /v2/parse

Dokumente

PDF (auch gescannt, mit Texterkennung), Word, Excel, PowerPoint, OpenDocument, EPUB und CSV als sauberes Markdown – per Upload oder Link.

Umstieg in zwei Minuten

Die API ist kompatibel zu den verbreiteten Open-Source-SDKs für Firecrawl (Python und Node.js) und zu Integrationen wie LangChain oder n8n. Du tauschst nur die Basis-URL und den API-Key aus, der restliche Code bleibt gleich.

Firecrawl ist eine Marke ihres jeweiligen Inhabers. Ragfeed ist ein unabhängiges Produkt und nicht mit Firecrawl verbunden.

app = Firecrawl(
    api_key="sk-...",
    api_url="https://api.ragfeed.de",   # ← die einzige Änderung
)

job = app.crawl("https://docs.example.com", limit=200)
for page in job.data:
    print(page.metadata.source_url, len(page.markdown))

Faire Preise nach Credits

Eine normale Seite kostet 1 Credit. Monatliche Plan-Credits erneuern sich mit jedem Abrechnungszeitraum, zugekaufte Credit-Pakete verfallen nicht. Abos sind monatlich kündbar.

Free

0 €
  • 1.000 Credits / Monat
  • 2 parallele Requests
  • Alle Endpunkte
Kostenlos starten

Hobby

9 € / Monat
  • 5.000 Credits / Monat
  • 3 parallele Requests
  • E-Mail-Support
Hobby buchen

Growth

199 € / Monat
  • 500.000 Credits / Monat
  • 25 parallele Requests
  • Priorisierter Support
Growth buchen

Credit-Pakete ohne Abo: 10.000 Credits für 19 € · 100.000 Credits für 99 €

Was kostet wie viel?

VorgangCredits
Seite scrapen oder crawlen (Markdown, HTML, Links, Screenshot …)1 pro Seite
PDF1 pro PDF-Seite, gescannte Seiten mit Texterkennung 2
Word, Excel, PowerPoint, OpenDocument, EPUB, CSV1 pro Dokument
KI-Formate (JSON-Schema, Zusammenfassung, Frage, Produkt …)+5 pro Format
Verstärkter Proxy für schwierige Seiten+4 pro Seite
Map (alle URLs einer Domain)1 pro Aufruf
Suche2 pro 10 Ergebnisse (+ Scrape-Kosten, falls Inhalte geladen werden)
Extract5 pro verarbeiteter Seite

Fehlgeschlagene Seiten (Timeout, nicht erreichbar) werden nicht berechnet. Gemäß § 19 UStG wird keine Umsatzsteuer berechnet.

Häufige Fragen

Werden robots.txt und Crawl-Delay beachtet?

Ja. Beim Crawlen werden robots.txt und Crawl-Delay standardmäßig respektiert. Gesperrte URLs listet der Endpunkt /v2/crawl/{id}/errors auf.

Was passiert, wenn meine Credits aufgebraucht sind?

Neue Anfragen erhalten HTTP 402. Laufende Crawls stoppen sauber und liefern die bis dahin gesammelten Seiten. Credits kannst du im Dashboard jederzeit nachkaufen.

Wie lange werden Ergebnisse gespeichert?

Crawl- und Batch-Ergebnisse sind 24 Stunden abrufbar und werden danach gelöscht. Screenshots bleiben 24 Stunden verfügbar.

Kann ich meine bestehenden Firecrawl-Integrationen weiterverwenden?

In den allermeisten Fällen ja: v1- und v2-Endpunkte, die offiziellen Python- und Node-SDKs sowie gängige Integrationen funktionieren, wenn du Basis-URL und Key austauschst. Nicht unterstützt werden derzeit die Formate branding, audio und video.

Welche Daten darf ich scrapen?

Du bist dafür verantwortlich, nur Inhalte abzurufen, zu deren Nutzung du berechtigt bist, und Urheber-, Datenschutz- und Vertragsrecht der Zielseiten zu beachten. Details stehen in den AGB.