Query Rewriting / Query Expansion - die Suchanfrage vor RAG verbessern
Query Rewriting formuliert die Nutzerfrage vor der Suche um oder erweitert sie - für besseres RAG-Retrieval, noch bevor die Vektordatenbank durchsucht wird.
Query Rewriting (Umformulieren) und Query Expansion (Erweitern) bezeichnen Techniken, die eine Nutzerfrage vor dem eigentlichen Suchvorgang aufbereiten. In einer RAG-Anwendung entscheidet die Qualität der Suchanfrage maßgeblich darüber, ob die passenden Belege überhaupt gefunden werden. Eine knappe, mehrdeutige oder umgangssprachlich formulierte Frage trifft die relevanten Dokumente oft nicht - deshalb wird sie zuerst in eine oder mehrere bessere Suchanfragen übersetzt, bevor die Vektordatenbank durchsucht wird.
Warum die Originalfrage oft nicht genügt
- Wortschatz-Lücke: Nutzer und Dokumente verwenden unterschiedliche Begriffe für dieselbe Sache. Fragt jemand nach "Kündigung", das Dokument spricht aber von "Vertragsbeendigung", fehlt die Brücke.
- Zu knappe Anfragen: Stichworte oder unvollständige Sätze tragen wenig Bedeutung, an der sich die semantische Suche orientieren kann.
- Fehlender Gesprächskontext: In einem Dialog bezieht sich eine Folgefrage ("und was kostet das?") auf Vorheriges. Ohne diesen Kontext ist sie allein nicht durchsuchbar.
Umformulieren und Erweitern
- Query Rewriting (Umformulieren): Die Frage wird in eine klarere, vollständige Fassung übersetzt - Mehrdeutigkeiten werden aufgelöst, fehlender Kontext aus dem Gespräch wird ergänzt, umgangssprachliche Formulierungen werden begradigt. Aus der Folgefrage "und was kostet das?" wird etwa "Was kostet Produkt X im Tarif Y?".
- Query Expansion (Erweitern): Die Frage wird um verwandte Begriffe, Synonyme oder alternative Formulierungen ergänzt, um mehr passende Treffer abzudecken. Häufig entstehen dabei mehrere Suchvarianten aus einer einzigen Frage, deren Ergebnisse anschließend zusammengeführt werden.
Beide Ansätze schließen sich nicht aus - oft wird eine Frage zuerst begradigt und dann erweitert. In beiden Fällen übernimmt meist ein Sprachmodell die Aufbereitung, weil es Bedeutung und Kontext erfasst.
Abgrenzung: vor und nach der Suche
Query Rewriting setzt am Anfang der Retrieval-Kette an - noch bevor gesucht wird. Davon zu trennen sind Techniken, die an anderer Stelle greifen:
- Hybrid Search betrifft die Art der Suche selbst: Sie kombiniert semantische Vektorsuche mit klassischer Stichwortsuche. Query Rewriting verbessert die Anfrage, die in diese Suche hineingeht - beide ergänzen sich, arbeiten aber an unterschiedlichen Stellen.
- Reranking greift erst nach der Suche: Es sortiert die zurückgelieferten Treffer nach Relevanz neu. Query Rewriting bestimmt, welche Treffer überhaupt gefunden werden; Reranking ordnet die bereits gefundenen. Was eine schlechte Anfrage gar nicht erst findet, kann kein Reranking nachträglich hervorholen - deshalb ist die Aufbereitung der Anfrage der frühere und oft entscheidende Hebel.
In der Praxis wirken die drei zusammen: eine gute Anfrage (Query Rewriting), eine robuste Suche (Hybrid Search) und eine saubere Sortierung der Treffer (Reranking) ergeben zusammen ein belastbares Retrieval.
Query Rewriting bei Elasticbrains
Bei Elasticbrains stimmen wir die Aufbereitung der Suchanfrage auf Ihre Inhalte und Nutzerfragen ab - vom Auflösen von Gesprächskontext bis zum gezielten Erweitern um Fachbegriffe, damit die Suche findet, was die Frage wirklich meint. Wie daraus eine belegbare Wissensbasis entsteht, zeigen wir auf unserer Leistungsseite interne KI-Assistenten / RAG-Wissensdatenbank.
Häufige Fragen
Was ist Query Rewriting bei RAG?
Was ist der Unterschied zwischen Query Rewriting und Query Expansion?
Was ist der Unterschied zwischen Query Rewriting und Reranking?
Warum genügt die Originalfrage oft nicht?
Weitere Glossarbegriffe
AgentOps - KI-Agenten zuverlässig in Produktion betreiben
AgentOps steht für den zuverlässigen Betrieb von KI-Agenten in Produktion - analog zu DevOps. Monitoring von Qualität, Kosten, Latenz plus Regressionen.
Embeddings - Vektoren als Bedeutungs-Fingerabdruck
Ein Embedding übersetzt Text oder Bild in einen Vektor, der Bedeutung als Position im Raum abbildet - Grundlage für Ähnlichkeitssuche, Empfehlungen und RAG.
KI-Halluzination - wenn ein Sprachmodell Fakten erfindet
Eine KI-Halluzination ist eine plausibel klingende, aber falsche Ausgabe eines Sprachmodells. Warum das passiert - und wie RAG und Guardrails gegensteuern.
Bereit, das in die Praxis zu bringen?
Lassen Sie uns in einem kostenlosen Erstgespräch über Ihr Vorhaben sprechen - unverbindlich und konkret.