Die llms.txt ist ein Vorschlag für eine Textdatei, mit der eine Website großen Sprachmodellen (Large Language Models, LLMs) und KI-Agenten zeigt, welche ihrer Inhalte wichtig sind und wo sie zu finden sind. Vorgestellt hat ihn Jeremy Howard im September 2024. Die Datei liegt in der Regel direkt unter der Domain, also unter /llms.txt, und ist in Markdown geschrieben. Damit ist sie für Menschen und Maschinen gleichermaßen lesbar.

Aufbau

Der Vorschlag gibt eine feste Reihenfolge vor:

  1. eine Überschrift erster Ebene mit dem Namen der Website oder des Projekts, der einzige Pflichtbestandteil
  2. ein Zitatblock mit einer kurzen Zusammenfassung
  3. bei Bedarf weitere Absätze oder Listen mit Hintergrundinformationen
  4. Abschnitte mit Überschriften zweiter Ebene, die Linklisten enthalten, jeweils mit einer kurzen Notiz zum Inhalt der verlinkten Seite

Ein Abschnitt mit dem Titel „Optional“ kennzeichnet nach Konvention Links, die ein System bei knappem Kontext überspringen kann. Ergänzend schlägt der Vorschlag vor, wichtige Seiten zusätzlich als reine Markdown-Fassung anzubieten. Manche Websites stellen außerdem eine llms-full.txt bereit, die den Volltext ihrer Inhalte in einer Datei bündelt. Das ist eine Konvention, die nicht zum Vorschlag gehört.

Wozu die Datei dient

Webseiten enthalten viel, was für ein Sprachmodell nur Ballast ist: Navigation, Skripte, Layout. Eine llms.txt liefert stattdessen eine knappe, von der Website selbst kuratierte Zusammenfassung. Sie passt gut in das begrenzte Kontextfenster eines Modells und hilft KI-Agenten, die passende Seite zu finden. Für GEO ist sie damit ein Baustein, um ein Angebot klar und in eigenen Worten zu beschreiben.

Google prüft die llms.txt in Lighthouse

Google hat die llms.txt in sein Prüfwerkzeug Lighthouse aufgenommen, das auch hinter PageSpeed Insights steht. Sie ist dort Teil der experimentellen Kategorie Agentic Browsing, die bewertet, wie gut eine Website für KI-Agenten gebaut ist, und die prüft, ob die Datei abrufbar ist und einige Mindestanforderungen erfüllt. Google beschreibt die Datei als entstehende Konvention, die speziell für Sprachmodelle und KI-Agenten gedacht ist: Ohne sie brauchen Agenten unter Umständen länger, um Aufbau und wichtigste Inhalte einer Website zu erfassen. Weil eine llms.txt mit wenig Aufwand erstellt ist, lohnt sie sich für die meisten Websites.

Abgrenzung

Die llms.txt regelt keinen Zugriff. Welche Crawler eine Website lesen dürfen, legt weiterhin die robots.txt fest. Die llms.txt ersetzt auch keine strukturierten Daten, die Fakten direkt auf der jeweiligen Seite maschinenlesbar auszeichnen.

Ein verbindlicher Standard ist die llms.txt bislang nicht; wie ein KI-System sie auswertet, entscheidet jeder Anbieter selbst. Wie jede einzelne Maßnahme garantiert sie keine Erwähnung und kein KI-Zitat, sie ist aber ein einfacher Baustein, um ein Angebot für KI-Systeme klar zu beschreiben.