Ralf Cornesse · · 16:56 Minuten
Audiodatei herunterladenShownotes
RAG ist die Abkürzung für Retrieval Augmented Generation, wörtlich die abrufgestützte Texterzeugung. In unseren Projekten ist es der Baustein, der am schnellsten etwas einbringt: Verträge, Handbücher und Prozessbeschreibungen werden für die KI zugänglich, ohne dass sie das Unternehmen verlassen.
Themen in dieser Folge
- Warum ein Sprachmodell dein Firmenwissen nicht kennt
- Wie RAG funktioniert, vom Suchvorgang über die Fundstellen bis zur Antwort
- Praxisbeispiel Reparaturanfrage mit Fehlercode
- Warum das Sprachmodell nichts dazulernt und sich jederzeit austauschen lässt
- Qualität hängt an der Datenbasis, Aufräumen als Pflichtvorarbeit
- Dokumente in Schnipsel zerlegen und die passende Größe finden
- Mehrere RAGs pro Abteilung mit klaren Berechtigungen
- Embedding und Reranking kurz erklärt
- Werkzeuge vom Einstieg mit Open WebUI bis zu Systemen, die nur für RAG gebaut sind
- Fünf Empfehlungen aus unseren Projekten
- Warum lokale KI bei Firmendokumenten die passende Grundlage ist