Hilft die Datei llms.txt dabei, von KIs zitiert zu werden?
Veröffentlicht am
Nichts deutet darauf hin, dass die Datei llms.txt dabei hilft, von KIs zitiert zu werden. Es handelt sich um einen Vorschlag aus dem Jahr 2024, dessen Nutzung von keinem großen KI-Entwickler zur Auswahl seiner Quellen dokumentiert wird, und Google schreibt im Juli 2026, dass es überflüssig ist, Textdateien für die KI zu erstellen. Wir haben es gemessen: Unter den Websites, die durch die Suche von ChatGPT, Claude und Gemini in rund zehn Branchen ermittelt wurden, veröffentlichen 17 % eine llms.txt, und die zitierten Websites veröffentlichen diese nicht wesentlich häufiger als die anderen. Bei ChatGPT ist es sogar geringfügig umgekehrt.
Für welche Art von Frage? Es hängt alles davon ab, was man von der Datei erwartet. Nichts deutet darauf hin, dass sie nützlich ist, um in der Antwort einer KI auf eine Frage zitiert zu werden. Sie wurde vorgeschlagen, um KI-Tools beim Lesen einer Website zu helfen, beispielsweise einer technischen Dokumentation, was wir nicht gemessen haben.
Was die Datei llms.txt ist
Die Datei llms.txt wurde am 3. September 2024 von Jeremy Howard vorgeschlagen. Die Idee besteht darin, im Stammverzeichnis einer Website eine Datei im Markdown-Format bereitzustellen, die für Sprachmodelle lesbar ist und die Website vorstellt. Das Format erfordert einen Titel mit dem Namen der Website, dann in der Regel eine kurze Zusammenfassung und Listen mit Links zu wichtigen Seiten, mit einem optionalen Abschnitt für das, was ein Tool ignorieren kann, wenn der Platz knapp ist.
Diese Datei wird in GEO-Empfehlungen oft als eine Möglichkeit dargestellt, ChatGPT, Claude oder Gemini zu den richtigen Seiten zu führen. In den Dokumentationen von OpenAI, Anthropic und Google, die wir gelesen haben, erwähnt keine, dass sie diese zur Auswahl ihrer Quellen nutzen. Sie ersetzt nicht die Datei robots.txt, die den Bots mitteilt, was sie lesen dürfen.
Was Google und die Studien sagen
Google antwortet in seinem am 10. Juli 2026 aktualisierten Leitfaden zur Optimierung für seine generativen KI-Funktionen: Es ist überflüssig, Textdateien für die KI zu erstellen, da seine Suche diese nicht verwendet. Bereits im April 2025 stellte John Mueller von Google fest, dass ihm kein KI-Dienst bekannt sei, der diese Datei offiziell nutzt, und dass man in den Server-Protokollen sieht, dass diese Dienste sie nicht sogar abrufen.
SE Ranking veröffentlichte im November 2025 eine Analyse von fast 300.000 Domains, von denen rund 10 % eine llms.txt veröffentlichten. Fazit: Das Vorhandensein dieser Datei machte eine Domain nicht wahrscheinlicher, von KI-Modellen zitiert zu werden. Der Anbieter hält die Implementierung im Hinblick auf eine zukünftige Nutzung jedoch für risikoarm.
Was wir gemessen haben
Wir haben die Websites herangezogen, die durch die Suche von ChatGPT, Claude und Gemini in rund zehn am 10. September 2026 auf Französisch abgefragten Branchen ermittelt wurden, und am 16. September überprüft, ob jede eine gültige llms.txt mit dem Titel im vorgesehenen Format veröffentlicht. Vor der Messung hatten wir unsere Prognose aufgeschrieben: Weniger als 10 % der Websites würden eine veröffentlichen, und der Unterschied zwischen zitierten und nicht zitierten Websites würde bei keiner KI mehr als 3 Prozentpunkte betragen.
Die erste Prognose ist nicht eingetroffen: 17 % der Websites veröffentlichen eine llms.txt, also mehr als erwartet. Die Abweichungen bleiben gering und weisen nicht in dieselbe Richtung: Bei Claude sind es 16 % der zitierten Websites gegenüber 12 % der nicht zitierten; bei ChatGPT 14 % der zitierten gegenüber 16 % der nicht zitierten. Ein statistischer Permutationstest zeigt, dass diese Abweichungen mit dem Zufall vereinbar sind. Bei Gemini, dessen API nicht zwischen ausgeschlossenen Seiten unterscheidet, veröffentlichen 23 % der zitierten Websites eine solche, ohne dass ein Vergleichswert vorliegt.
Warum die Datei nicht dazu beitragen kann, dass eine Seite zitiert wird
Bei ChatGPT und Claude wird eine Seite zunächst durch eine von der KI selbst generierte Suche gefunden und dann aus den Ergebnissen ausgewählt. Was bei diesen beiden Schritten in unseren Messungen zählt, ist die Position der Seite in den Suchergebnissen, die Wörter der Frage im Titel und in der Webadresse sowie Absätze, die das Vokabular der Suche zur Beantwortung nutzen. Eine separate Datei, die von der Suche nicht gelesen wird, spielt in keinem dieser Schritte eine Rolle.
Diese Website veröffentlicht selbst eine llms.txt-Datei, die ihre Seiten auflistet. Wir behaupten nicht, dass sie dazu führt, dass wir zitiert werden: Es ist eine weitere Zusammenfassung, kein gemessener Hebel.
Was das für ein Unternehmen ändert
Wenn Ihre Website keine llms.txt hat, ist das nicht der Grund für Ihr Fehlen in den KIs. Beginnen Sie mit dem, was messbar ist: dem Zugriff der Such-Bots der KIs auf Ihre Website, Seiten, die die Fragen Ihrer Kunden mit deren eigenen Worten beantworten, und einer Präsenz in den Quellen, die von den KIs konsultiert werden.
Das Veröffentlichen einer llms.txt kostet fast nichts und schadet nicht. Aber ein Dienstleister, der sie als Hebel zur Zitierung darstellt, verkauft ein Versprechen, das weder Google noch die Studien noch unsere Messungen bestätigen.
Was wir nicht wissen
Unsere Messung bezieht sich auf die erfassten Websites aus rund zehn Sektoren auf Französisch, die sechs Tage nach der Erfassung überprüft wurden: Eine Website kann ihre Datei in der Zwischenzeit hinzugefügt oder entfernt haben. Sie vergleicht zitierte und nicht zitierte Websites, was eine Assoziation beschreibt, keinen Effekt. Wir haben die Nutzung der Datei durch Agenten, die eine Dokumentation lesen, nicht gemessen.
Quellen
- Jeremy Howard — „The /llms.txt file“, Vorschlag, .
- Google Search Central — „Optimizing your website for generative AI features on Google Search“, .
- Search Engine Journal, Roger Montti — Google vergleicht llms.txt mit dem Meta-Keywords-Tag, .
- SE Ranking, Yulia Deda — llms.txt und Zitate durch KIs, .
- Messungen von FaireDuBruit vom 4. bis 16. September 2026 — siehe „Wie wir gemessen haben“.