Jede Website als sauberes Markdown und strukturierte Daten.
Ragfeed rendert Seiten mit echtem Browser, entfernt Navigation, Werbung und Cookie-Banner und liefert Markdown, HTML, Screenshots oder JSON nach deinem Schema. Einzelne Seiten, ganze Websites, Suche und KI-Extraktion über eine API.
curl -X POST https://api.ragfeed.de/v2/scrape \
-H "Authorization: Bearer sk-..." \
-H "Content-Type: application/json" \
-d '{"url": "https://example.com", "formats": ["markdown"]}'
# pip install firecrawl-py (kompatibles Open-Source-SDK)
from firecrawl import Firecrawl
app = Firecrawl(api_key="sk-...", api_url="https://api.ragfeed.de")
doc = app.scrape("https://example.com", formats=["markdown"])
print(doc.markdown)
// npm i @mendable/firecrawl-js (kompatibles Open-Source-SDK)
import Firecrawl from "@mendable/firecrawl-js";
const app = new Firecrawl({ apiKey: "sk-...", apiUrl: "https://api.ragfeed.de" });
const doc = await app.scrape("https://example.com", { formats: ["markdown"] });
console.log(doc.markdown);
Alles, was ein KI-Agent vom Web braucht
Fünf Endpunkte decken Einzelseiten, ganze Websites und die offene Websuche ab.
Scrape
Eine URL wird zu Markdown, HTML, Links, Bildern, Screenshot oder JSON. JavaScript-Seiten werden im Browser gerendert, PDFs als Text geliefert.
Crawl
Ganze Websites inklusive Sitemap, mit Pfadfiltern, Tiefenlimit, robots.txt-Beachtung und Webhooks pro Seite.
Map
In Sekunden alle URLs einer Domain. Mit Suchbegriff bekommst du sie nach Relevanz sortiert.
Search
Websuche mit optional direkt gescrapten Ergebnissen, auch für News und Bilder.
Extract
Strukturierte Daten nach deinem JSON-Schema, auch über viele Seiten hinweg (example.com/*).
Browser-Aktionen
Klicken, Tippen, Scrollen, Warten und JavaScript ausführen, bevor der Inhalt erfasst wird.
Dokumente
PDF (auch gescannt, mit Texterkennung), Word, Excel, PowerPoint, OpenDocument, EPUB und CSV als sauberes Markdown – per Upload oder Link.
Umstieg in zwei Minuten
Die API ist kompatibel zu den verbreiteten Open-Source-SDKs für Firecrawl (Python und Node.js) und zu Integrationen wie LangChain oder n8n. Du tauschst nur die Basis-URL und den API-Key aus, der restliche Code bleibt gleich.
Firecrawl ist eine Marke ihres jeweiligen Inhabers. Ragfeed ist ein unabhängiges Produkt und nicht mit Firecrawl verbunden.
app = Firecrawl(
api_key="sk-...",
api_url="https://api.ragfeed.de", # ← die einzige Änderung
)
job = app.crawl("https://docs.example.com", limit=200)
for page in job.data:
print(page.metadata.source_url, len(page.markdown))
Faire Preise nach Credits
Eine normale Seite kostet 1 Credit. Monatliche Plan-Credits erneuern sich mit jedem Abrechnungszeitraum, zugekaufte Credit-Pakete verfallen nicht. Abos sind monatlich kündbar.
Standard
- 100.000 Credits / Monat
- 10 parallele Requests
- Priorisierter Support
Growth
- 500.000 Credits / Monat
- 25 parallele Requests
- Priorisierter Support
Credit-Pakete ohne Abo: 10.000 Credits für 19 € · 100.000 Credits für 99 €
Was kostet wie viel?
| Vorgang | Credits |
|---|---|
| Seite scrapen oder crawlen (Markdown, HTML, Links, Screenshot …) | 1 pro Seite |
| 1 pro PDF-Seite, gescannte Seiten mit Texterkennung 2 | |
| Word, Excel, PowerPoint, OpenDocument, EPUB, CSV | 1 pro Dokument |
| KI-Formate (JSON-Schema, Zusammenfassung, Frage, Produkt …) | +5 pro Format |
| Verstärkter Proxy für schwierige Seiten | +4 pro Seite |
| Map (alle URLs einer Domain) | 1 pro Aufruf |
| Suche | 2 pro 10 Ergebnisse (+ Scrape-Kosten, falls Inhalte geladen werden) |
| Extract | 5 pro verarbeiteter Seite |
Fehlgeschlagene Seiten (Timeout, nicht erreichbar) werden nicht berechnet. Gemäß § 19 UStG wird keine Umsatzsteuer berechnet.
Häufige Fragen
Werden robots.txt und Crawl-Delay beachtet?
Ja. Beim Crawlen werden robots.txt und Crawl-Delay standardmäßig respektiert. Gesperrte URLs listet der Endpunkt /v2/crawl/{id}/errors auf.
Was passiert, wenn meine Credits aufgebraucht sind?
Neue Anfragen erhalten HTTP 402. Laufende Crawls stoppen sauber und liefern die bis dahin gesammelten Seiten. Credits kannst du im Dashboard jederzeit nachkaufen.
Wie lange werden Ergebnisse gespeichert?
Crawl- und Batch-Ergebnisse sind 24 Stunden abrufbar und werden danach gelöscht. Screenshots bleiben 24 Stunden verfügbar.
Kann ich meine bestehenden Firecrawl-Integrationen weiterverwenden?
In den allermeisten Fällen ja: v1- und v2-Endpunkte, die offiziellen Python- und Node-SDKs sowie gängige Integrationen funktionieren, wenn du Basis-URL und Key austauschst. Nicht unterstützt werden derzeit die Formate branding, audio und video.
Welche Daten darf ich scrapen?
Du bist dafür verantwortlich, nur Inhalte abzurufen, zu deren Nutzung du berechtigt bist, und Urheber-, Datenschutz- und Vertragsrecht der Zielseiten zu beachten. Details stehen in den AGB.