Grounding macht den Unterschied zwischen einer KI-Antwort aus dem Gedächtnis eines Sprachmodells und einer Antwort, die sich auf nachprüfbare Quellen stützt. Fragt jemand ChatGPT, Gemini, Claude oder Perplexity etwa nach den Öffnungszeiten eines Handwerksbetriebs, kann das System die aktuelle Website des Betriebs heranziehen und in der Antwort als Quelle angeben, statt sich allein auf das zu verlassen, was sein Modell im Training gelernt hat. Den Begriff verwenden unter anderem Google und Microsoft in ihren Dokumentationen zu Gemini und Copilot; Google übersetzt ihn im Deutschen mit „Fundierung“.

Wie Grounding funktioniert

Ohne Grounding antwortet ein Sprachmodell aus seinem parametrischen Wissen, also aus dem, was es im Training gespeichert hat. Verlässlich auf eine bestimmte Quelle zurückführen lässt sich dieses Wissen nicht. Beim Grounding erhält das Modell vor dem Schreiben zusätzlich passende Inhalte und formuliert seine Antwort auf dieser Grundlage. Google beschreibt Grounding als die Fähigkeit, die Ausgabe eines Modells mit überprüfbaren Informationsquellen zu verbinden.

Wie die Inhalte zum Modell kommen, regelt das Verfahren dahinter, meist Retrieval-Augmented Generation (RAG): Das System ruft passende Inhalte ab, bei Antworten mit Webinhalten in der Regel aus einem Webindex, einer Sammlung von Webseiten, die Crawler (Programme, die Webseiten automatisch abrufen) vorab erfasst haben. In seinem Leitfaden zu den KI-Funktionen der Google Suche behandelt Google RAG und Grounding als zwei Namen für dieselbe Technik. Wo zwischen beiden unterschieden wird, etwa in Microsofts Dokumentation, beschreibt RAG den Weg: erst Inhalte abrufen, dann die Antwort schreiben. Grounding beschreibt das Ziel: eine Antwort, deren Aussagen sich auf bestimmte Quellen zurückführen lassen. Deshalb ist auch dann von Grounding die Rede, wenn das System die Quellen nicht selbst auswählt, sondern vorgegeben bekommt, etwa Webadressen, die zusammen mit der Frage an das Modell gehen.

Sichtbar wird Grounding meist an den Quellenangaben. Microsoft beschreibt für Copilot, dass Antworten, die auf Webinhalten beruhen, die verwendeten Websites als Links unter dem Text aufführen. Bei Gemini und Claude ordnen die Programmierschnittstellen für Entwickler jede Quellenangabe sogar einer bestimmten Textstelle der Antwort zu. So lässt sich nachprüfen, worauf sich eine Aussage stützt.

Warum Grounding für GEO zählt

Grounding ist der Weg, auf dem eine Website zur Quelle einer KI-Antwort wird: Nur Seiten, die ein System für eine Antwort heranzieht, kann es verlässlich als Quelle angeben, also als KI-Zitat. Nennt ein Modell ein Unternehmen dagegen nur aus dem, was es im Training gelernt hat, fehlt meist die Quellenangabe; das ist dann eine Erwähnung. In den Webmaster-Richtlinien von Bing beschreibt Microsoft GEO als Arbeit daran, dass Inhalte für das Grounding und als Quelle in KI-Antworten infrage kommen. Über Grounding können außerdem Angaben in eine Antwort gelangen, die erst nach dem Knowledge Cutoff eines Modells entstanden sind, etwa ein neues Produkt oder geänderte Preise.

Herangezogen werden kann allerdings nur, was ein KI-System erreicht. Laut Google nutzen die KI-Funktionen der Google Suche öffentlich zugängliche, crawlbare Inhalte für ihre Antworten. Wichtige Seiten sollten deshalb für Crawler erreichbar sein, im Webindex des jeweiligen Systems stehen und ihren Hauptinhalt schon im HTML enthalten, das der Server ausliefert, statt ihn erst per JavaScript nachzuladen (JavaScript-Rendering). Wie gut Crawler die Seiten einer Website erreichen und lesen können, beschreibt ihre Crawlbarkeit.

Bei Gemini kommt eine Besonderheit hinzu: Ob die Gemini-Apps die Inhalte einer Website für das Grounding nutzen dürfen, steuert die Regel für Google-Extended in der robots.txt der Website, also in der Datei, die Crawlern Regeln vorgibt. Dieselbe Regel entscheidet auch darüber, ob Google die Inhalte für das Training künftiger Gemini-Modelle verwenden darf.

Was Grounding nicht leistet

Grounding macht Antworten verlässlicher, aber nicht fehlerfrei. Google schreibt, dass Grounding Halluzinationen verringert, und nennt zugleich mehrere Stellen, an denen Fehler entstehen können: bei der Anfrage, mit der das System Quellen abruft, bei der Deutung der Ergebnisse und bei ihrer Verarbeitung zur Antwort. Auch eine Antwort mit Quellenangabe kann deshalb eine Halluzination enthalten.

Zudem beruht nicht jede Antwort auf Grounding: KI-Systeme entscheiden meist bei jeder Frage neu, ob sie Inhalte abrufen; Claude etwa tut das laut Anthropic, wenn eine Frage von aktuellen oder sich ändernden Informationen abhängt, zum Beispiel zu bestimmten Unternehmen oder Produkten.