So funktioniert Ragfeed
Stellen Sie sich Ragfeed als sehr schnellen, sorgfältigen Leser für Ihre KI vor. Er öffnet die Webseiten, die Sie ihm nennen, liest nur den eigentlichen Inhalt und legt ihn so geordnet ab, dass Ihre KI damit arbeiten kann. Werbung, Menüs und Cookie-Hinweise lässt er weg.
Was bei einem Abruf passiert
Was Sie bekommen
Sie wählen bei jeder Anfrage, in welcher Form Sie den Inhalt möchten. Mehrere Formen auf einmal sind möglich.
| Form | Wofür | Name in der API |
|---|---|---|
| Lesbarer Text mit Überschriften | Weitergeben an ChatGPT oder ein anderes Sprachmodell, Archivieren | markdown |
| KI-Text mit Quellenangabe | Ganze Seiten an ein Sprachmodell geben, mit Titel, Adresse und Abrufzeit am Anfang | llmMarkdown |
| Abschnitte mit Kontext | Wissensdatenbanken für Chatbots: Jeder Abschnitt weiß, zu welcher Seite und Überschrift er gehört | chunks |
| Tabellenfelder nach Ihrem Muster | Preise, Termine, Produktdaten direkt in Tabelle oder Datenbank | json |
| Kurzfassung | Überblick über viele Seiten | summary |
| Bildschirmfoto | Belege, Seiten mit wichtigen Bildern | screenshot |
Warum diese Formen Tokens sparen und Antworten verbessern, zeigt unsere Messung zu KI-gerechten Daten. Was jede Form kostet, steht unter Wie viele Credits kostet was?
Drei Wege, Ragfeed einzubinden
Jeder Weg braucht nur zwei Angaben: die Adresse https://api.ragfeed.de und Ihren API-Schlüssel. Den erhalten Sie nach der
kostenlosen Anmeldung. Er wird Ihnen einmal angezeigt; bewahren Sie ihn sicher auf wie ein Passwort.
In Automations-Tools wie n8n oder Make
Sie klicken einen Ablauf aus Bausteinen zusammen, zum Beispiel: „Jeden Morgen diese fünf Seiten abrufen, zusammenfassen lassen und per E-Mail schicken.“
- Fügen Sie einen Baustein für Web-Anfragen ein: in n8n HTTP Request, in Make HTTP · Make a request.
- Methode POST, Adresse
https://api.ragfeed.de/v2/scrape. - Kopfzeile
Authorizationmit dem WertBearer, einem Leerzeichen und Ihrem API-Schlüssel. - Als Inhalt (JSON) die Seite und die gewünschte Form:
{"url": "https://www.beispiel.de", "formats": ["markdown"]} - Das Ergebnis steht im Feld
data.markdown. Die nächsten Bausteine geben es an Ihre KI, in eine Tabelle oder in eine E-Mail.
In n8n gibt es außerdem einen eigenen Firecrawl-Baustein. Tragen Sie dort in den Zugangsdaten Ihren Schlüssel und als Adresse
https://api.ragfeed.de/v2 ein.
Wissensdatenbank aus Webseiten, zum Beispiel in Dify
Plattformen für Chatbots können Webseiten oft direkt in eine Wissensdatenbank laden. Manche nutzen dafür Firecrawl und erlauben eine eigene Adresse, etwa Dify.
- Öffnen Sie die Einstellungen für Datenquellen und wählen Sie Firecrawl.
- Tragen Sie Ihren API-Schlüssel ein und als Adresse (Base URL)
https://api.ragfeed.de. - Legen Sie eine Wissensdatenbank an und wählen Sie als Quelle eine Website. Die Plattform holt die Seiten dann über Ragfeed.
Erlaubt eine Plattform keine eigene Adresse für Firecrawl, funktioniert dieser Weg dort nicht. Weg 1 oder 3 geht immer.
Über die API und fertige Bibliotheken
Für eigene Anwendungen, Chatbots und KI-Agenten. Ragfeed funktioniert mit den verbreiteten Bibliotheken für Firecrawl in Python und Node.js. Bestehender Code läuft weiter, sobald Adresse und Schlüssel ausgetauscht sind.
from firecrawl import Firecrawl
app = Firecrawl(api_key="sk-...", api_url="https://api.ragfeed.de")
doc = app.scrape("https://www.beispiel.de", formats=["markdown"])
Bevor Sie loslegen
Die Technik ist in Minuten eingerichtet. Wichtiger sind drei Fragen, die Ihnen niemand abnehmen kann:
- Welche Quellen? Verlässliche Seiten, die Ihre Fragen wirklich beantworten.
- Wie oft? Täglich, wöchentlich oder nur bei Änderungen, je nachdem, wie schnell sich die Inhalte ändern.
- Darf ich das? Öffentliche Seiten auswerten ist grundsätzlich erlaubt, mit Grenzen beim Urheber- und Datenschutzrecht.
Wie Sie diese Fragen beantworten, zeigt unser Leitfaden zur Datenstrategie. Die Regeln für die Nutzung stehen in den Nutzungsregeln.
Begriffe kurz erklärt
- API
- Eine Programmierschnittstelle: der feste Weg, auf dem Programme miteinander sprechen. Ihre Anwendung schickt eine Anfrage, Ragfeed antwortet mit dem Ergebnis.
- API-Schlüssel
- Ihr persönliches Kennwort für die API. Daran erkennt Ragfeed, dass eine Anfrage von Ihnen kommt, und bucht die Credits von Ihrem Konto ab.
- Scrapen
- Den Inhalt einer einzelnen Webseite automatisch abrufen.
- Crawlen
- Eine ganze Website abrufen, indem man von Seite zu Seite den Links folgt.
- Credit
- Die Abrechnungseinheit von Ragfeed. Eine normale Webseite kostet 1 Credit, aufwendigere Abrufe mehr.
- Token
- Ein Textstück, meist ein Wortteil. Sprachmodelle lesen und rechnen in Tokens ab. Weniger Tokens bedeuten geringere Kosten und schnellere Antworten.
- Sprachmodell
- Die KI hinter Chatbots wie ChatGPT. Sie versteht und schreibt Text, kennt aber nur, was in ihren Trainingsdaten stand oder was man ihr mitgibt.
- Markdown
- Ein einfaches Textformat, in dem Überschriften, Listen und Tabellen mit wenigen Zeichen markiert sind. Menschen und KI lesen es gleichermaßen gut.
- Chunk
- Ein Abschnitt einer Seite, klein genug, dass eine Suche ihn gezielt finden kann. Bei Ragfeed trägt jeder Chunk seine Überschriften und die Adresse der Seite.
- Wissensdatenbank
- Eine Sammlung von Abschnitten, in der ein Chatbot vor jeder Antwort nachschlägt. Technisch oft eine Vektordatenbank, die nach Bedeutung statt nach genauen Wörtern sucht.
- RAG
- Kurz für Retrieval-Augmented Generation: Die KI sucht zuerst passende Abschnitte heraus und formuliert dann ihre Antwort auf deren Grundlage.
- JSON
- Ein Format für Daten in Feldern, etwa Name, Preis und Datum. Tabellen, Datenbanken und Automations-Tools verarbeiten es direkt.
- Automations-Tool
- Programme wie n8n oder Make, in denen Sie Abläufe aus Bausteinen zusammenklicken, ohne zu programmieren.
- robots.txt
- Eine Datei, in der Website-Betreiber festlegen, welche Bereiche automatische Programme abrufen dürfen.
Probieren Sie es mit Ihren eigenen Seiten.
1.000 Seiten im Monat kostenlos, ohne Kreditkarte.