Ein Opt-out aus KI-Antworten setzt dort an, wo ein KI-System eine Frage beantwortet: Es legt fest, ob das System die Inhalte einer Website dafür heranziehen, zusammenfassen und als Quelle angeben darf. Damit ist es das Gegenstück zum KI-Trainings-Opt-out, bei dem es darum geht, ob Inhalte in das Training künftiger Sprachmodelle einfließen. Für GEO ist es eine Grundsatzentscheidung: Inhalte, die ein KI-System wegen eines Opt-outs nicht nutzen darf, kann es in den betroffenen Antworten auch nicht als KI-Zitat angeben.
Jeder Anbieter hat eigene Wege
Einen Schalter, der Inhalte bei allen KI-Anbietern zugleich aus den Antworten nimmt, gibt es nicht. Jeder Anbieter legt selbst fest, wie Website-Betreiber ihre Inhalte aus seinen Antworten heraushalten können. Für ChatGPT, Gemini, Claude und Perplexity sind das diese Wege (Stand: Oktober 2026):
- ChatGPT: eine Regel für OAI-SearchBot in der robots.txt der Website. Die Zeilen „User-agent: OAI-SearchBot“ und „Disallow: /“ sperren den Crawler, also das Programm, das Websites für ChatGPT search automatisch abruft. ChatGPT zeigt eine so gesperrte Website laut OpenAI nicht in den Antworten von ChatGPT search; dort kann sie aber weiterhin als einfacher Link erscheinen.
- Gemini: eine Regel für Google-Extended. Das ist ein Token, also ein Name, den eine Regel in der robots.txt ansprechen kann; einen eigenen Crawler gibt es dafür nicht. Laut Google regelt es, ob Inhalte für das Grounding in den Gemini-Apps genutzt werden dürfen, also dafür, Antworten auf aktuelle Webinhalte zu stützen.
- Claude: eine Regel für Claude-SearchBot, mit dem Anthropic Seiten für die Websuche von Claude erfasst; laut Anthropic kann eine Sperre die Sichtbarkeit einer Website dort verringern. Auch Claude-User, der Seiten abruft, wenn jemand Claude eine Frage stellt, befolgt laut Anthropic die robots.txt; eine Sperre verhindert, dass Claude die Inhalte für eine solche Frage abruft.
- Perplexity: eine Regel für PerplexityBot, mit dem Perplexity Websites erfasst, um sie in seinen Antworten anzuzeigen und zu verlinken. Auch nach einer Sperre kann Perplexity laut eigener Aussage Domain, Überschrift und eine kurze sachliche Zusammenfassung einer Seite in seinen Index aufnehmen.
Ob eine Website in den KI-Funktionen der Google Suche erscheint, also in der Übersicht mit KI, im KI-Modus und in den KI-Funktionen von Google Discover, regelt laut Google nicht Google-Extended. Dafür gibt es seit dem 31. August 2026 für alle Websites weltweit die Einstellung „Generative KI in der Google Suche“ in der Google Search Console, Googles Werkzeug für Website-Betreiber. Daneben nennt Google die Regeln der robots.txt für Googlebot, seinen Crawler, und Anweisungen für einzelne Seiten: nosnippet etwa verhindert, dass der Inhalt einer Seite als direkte Grundlage für die Übersicht mit KI und den KI-Modus dient. Solche Anweisungen stehen als Robots-Meta-Tag im HTML-Code einer Seite oder als X-Robots-Tag in der Antwort des Servers. Ein Crawler sieht sie nur, wenn die robots.txt ihm den Abruf der Seite erlaubt.
Für Microsoft Copilot nennt Microsoft ähnliche Anweisungen: noarchive verhindert, dass Copilot den Inhalt einer Seite für seine Antworten nutzt, nocache beschränkt Copilot auf Adresse, Titel und Kurzbeschreibung der Seite.
Eine Lücke bleibt bei Abrufen, die eine Person selbst auslöst, etwa indem sie im Chat einen Link teilt. Für ChatGPT-User, einen solchen User-triggered Fetcher, gelten die Regeln der robots.txt laut OpenAI möglicherweise nicht. Laut Google ignorieren seine Fetcher dieser Art, etwa der für Gemini Notebook, die robots.txt in der Regel, und Perplexity sagt dasselbe über Perplexity-User. Ein Opt-out über die robots.txt erfasst diese Abrufe deshalb nicht bei jedem Anbieter.
Opt-out und Sichtbarkeit abwägen
Ein Opt-out aus KI-Antworten ist eine bewusste geschäftliche Entscheidung und keine Voreinstellung, die jede Website braucht. Gründe dafür können Inhalte sein, die nur gegen Bezahlung zugänglich sein sollen, oder Inhalte, die nur im Rahmen einer Lizenz genutzt werden dürfen. Der Preis ist KI-Sichtbarkeit: In den Antworten, die ein Opt-out abdeckt, fehlt die eigene Website als Quelle. Erwähnt werden kann ein Angebot dort trotzdem, etwa aus dem Trainingswissen eines Sprachmodells oder auf Grundlage anderer Websites.
Ein Opt-out muss nicht alles oder nichts sein. Es lässt sich auf einzelne Anbieter beschränken, mit Pfadregeln in der robots.txt auf einzelne Verzeichnisse wie ein Archiv mit veralteten Produktinformationen und mit Anweisungen wie nosnippet auf einzelne Seiten. Für Inhalte, die in KI-Antworten vorkommen sollen, gilt das Gegenteil: Sie brauchen den Zugang der KI-Index-Crawler.
Wie ein Opt-out ungewollt entsteht
Ein Opt-out kann auch entstehen, ohne dass es jemand beabsichtigt. Eine pauschale Gruppe aus „User-agent: *“ und „Disallow: /“, etwa aus einer Testumgebung übernommen, sperrt alle Crawler ohne eigene Gruppe, auch die der KI-Anbieter. Ein vergessenes nosnippet oder noarchive hält wichtige Seiten aus der Übersicht mit KI und dem KI-Modus oder aus den Antworten von Copilot heraus. Und eine Firewall, die unerwünschte Zugriffe abwehrt, oder ein Content-Delivery-Network (CDN), also ein Netz von Servern, das Seiten schneller ausliefert, kann KI-Crawler abweisen, obwohl die robots.txt sie erlaubt; solche Einstellungen fasst der Begriff Bot-Management zusammen.
Auch Regeln, die nur das Training betreffen sollen, können Antworten mit erfassen. Ein Beispiel ist die verwaltete robots.txt des CDN-Anbieters Cloudflare, die Cloudflare-Kunden als Präferenz gegen KI-Training einschalten können: Laut Cloudflares Dokumentation (Stand: August 2026) enthält sie unter anderem die Zeilen „User-agent: Google-Extended“ und „Disallow: /“. Laut Google schließt das die Inhalte nicht nur vom Training künftiger Gemini-Modelle aus, sondern auch vom Grounding in den Gemini-Apps, weil beides am selben Token hängt. Wer diese Präferenz einschaltet, entscheidet damit auch über die Sichtbarkeit in den Gemini-Apps. Im August und September 2026 kündigte Cloudflare an, die verwaltete robots.txt durch „Bot Preference Sync“ abzulösen; diese Funktion ist für Neukunden voreingestellt.
Anbieterübergreifende Signale
Daneben gibt es Vorschläge für Signale, die für alle Anbieter zugleich gelten sollen. Cloudflare veröffentlichte im September 2025 die Content Signals, eine Erweiterung der robots.txt: Die Angabe „ai-input=no“ in einer Zeile „Content-Signal“ soll ausdrücken, dass Inhalte nicht als Eingabe für KI-Antworten dienen, etwa für Grounding. Bei der Internet Engineering Task Force (IETF), die technische Standards für das Internet erarbeitet, entwirft die Arbeitsgruppe AI Preferences (AIPREF) ein ähnliches Vokabular; dessen Kategorie „ai-use“ steht für die Nutzung von Inhalten als Eingabe generativer KI-Modelle. Der Entwurf gibt laut seinen Autoren nicht den Konsens der Arbeitsgruppe wieder (Stand: September 2026).
OpenAI, Google, Anthropic und Perplexity erwähnen in ihrer Crawler-Dokumentation keines der beiden Signale (Stand: Oktober 2026). Eine solche Angabe ist deshalb nur eine erklärte Präferenz und ersetzt die Regeln für die einzelnen Crawler nicht.