Ist das, was man über GEO liest, wahr?
Veröffentlicht am
Nur teilweise. Unter den am weitesten verbreiteten GEO-Ratschlägen werden einige durch Studien und unsere Messungen bestätigt, wie die wenigen Zitate von Reddit und YouTube bei ChatGPT. Andere halten einer Messung nicht stand: Das schema.org-Markup, das Frage-Antwort-Format und die llms.txt-Datei führen nicht dazu, dass eine Seite zitiert wird. Und viele Zahlen kursieren ohne ihren Kontext: Die „+40%“ von GEO stammen von einer simulierten Suchmaschine, und Studien, die sich zu widersprechen scheinen, messen oft unterschiedliche Dinge. Was man über GEO liest, ist wahr, wenn man weiß, für welche KI, für welche Art von Frage und mit welcher Messung.
Für welche Art von Frage? Es hängt alles vom jeweiligen Ratschlag und der an die KI gestellten Frage ab. Ein Ratschlag kann für eine Frage funktionieren, die eine Marke nennt, und bei einer Marktfrage scheitern. Diese Seite gleicht die am weitesten verbreiteten Behauptungen mit dem ab, was wir über die API von drei KIs messen.
Die „+40% Sichtbarkeit“: Ein Laborergebnis
Die am häufigsten zitierte Zahl zu GEO stammt aus dem Artikel, der den Begriff geprägt hat und 2024 für die KDD-Konferenz angenommen wurde: GEO könnte die Sichtbarkeit in den Antworten generativer Suchmaschinen um bis zu 40% erhöhen. Dieser Gewinn wurde in einer simulierten Suchmaschine gemessen, in der GPT-3.5 seine Antwort auf der Grundlage bereits bereitgestellter Quellen verfasst. Er misst den Anteil einer Seite an der Antwort, nicht ihre Chancen, durch die vorausgehende Suche gefunden zu werden.
Ein 2025 auf der NeurIPS vorgestellter Benchmark, C-SEO Bench, kommt zu dem Schluss, dass die meisten Methoden der konversationellen Optimierung weitgehend wirkungslos, oft schädlich sind und dass ihre Gewinne schwinden, wenn mehrere Akteure sie anwenden. Unsere eigenen Messungen zeigen den Schritt, den die „+40%“ ignorieren: Bei ChatGPT werden etwa neun von zehn durch die Suche zurückgegebenen Seiten nicht zitiert.
Schema.org, FAQ, llms.txt: Drei Ratschläge, die nicht standhalten
Das Hinzufügen von schema.org-Markup ist einer der häufigsten GEO-Ratschläge. Ahrefs verglich 2026 Seiten, die dieses hinzugefügt hatten, mit Kontrollseiten und stellte keinen Nettoanstieg der Zitate fest, und Google schreibt, dass kein spezielles Markup erforderlich ist. In unseren Messungen weisen zwischen 12% und 31% der von Claude und Gemini zitierten Seiten keinerlei Markup auf. Das Schreiben im Frage-Antwort-Format schneidet nicht besser ab: Zwischen 74% und 93% der von Claude und Gemini zitierten Seiten haben einen Titel, der keine Frage ist.
Die Datei llms.txt, die als Möglichkeit zur Steuerung von KIs angepriesen wird, hat keine nachgewiesene Wirkung. Google schreibt, dass es unnötig ist, Textdateien für die KI zu erstellen. Bei den Websites, die durch die Suche der KIs in rund zehn Branchen auf Französisch zurückgegeben wurden, haben wir gemessen, dass die zitierten Websites eine llms.txt-Datei nicht deutlich häufiger veröffentlichen als die anderen, und die Abweichung kehrt sich von einer KI zur anderen um.
Reddit, YouTube, Wikipedia: Richtig und falsch, je nachdem, was man zählt
Man liest, dass Reddit, YouTube und Wikipedia die bevorzugten Quellen von KIs sind. Das stimmt für das, was ChatGPT zurückgibt, nicht aber für das, was es zitiert. In unseren Messungen wurden die durch seine Suche zurückgegebenen Seiten dieser drei Plattformen je nach Korpus in 0% bis 1,5% der Fälle zitiert, verglichen mit 10% bis 15% bei den anderen Seiten. Ahrefs stellt mit einer anderen Methode im April 2026 dieselbe Größenordnung fest: 1,93% der Reddit-Seiten und 0,51% der von ChatGPT abgerufenen YouTube-Videos werden am Ende zitiert. Zwei unabhängige Methoden stimmen überein.
Widersprüchliche Zahlen messen oft etwas anderes. Die ChatGPT zugeschriebenen „47,9%“ für Wikipedia beziehen sich nur auf deren Anteil unter den zehn am häufigsten zitierten Domains; über alle Zitate hinweg nennt die Originalstudie 7,8%. Ein Anteil an den Zitaten, ein Anteil an den Antworten und ein Anteil an den am häufigsten zitierten Domains messen nicht dasselbe, und die meisten Widersprüche zwischen Studien rühren daher.
Das Google-Ranking: Eine reale, aber schwächer werdende Verbindung
Man liest, dass KI-Antworten die ersten Google-Ergebnisse übernehmen. Für die AI Overviews maß Ahrefs etwa 76% der Zitate aus den Top 10, gefolgt von 37,9% im März 2026, allerdings mit einer anderen Methode, was zur Vorsicht beim Vergleich mahnt. Für ChatGPT ist die Verbindung viel schwächer: Nur 8% der von ihm zitierten Seiten befanden sich laut Ahrefs im August 2025 unter den Top 10 von Google für dieselbe Suchanfrage.
Was unsere Messungen bei ChatGPT zeigen, ist das Gewicht der Platzierung in den Ergebnissen der eigenen Suchen: Eine Seite auf den ersten drei Plätzen wird dort 6,9- bis 8,5-mal häufiger zitiert als eine Seite jenseits des neunten Platzes. Der Ratschlag „Sorgen Sie für ein gutes Ranking“ ist also für Google richtig, muss aber für ChatGPT umformuliert werden: Man muss bei den Suchen, die die KI selbst schreibt, gut platziert sein.
Was die KIs aus dieser Frage gemacht haben
Wir haben ChatGPT, Claude und Gemini ohne weiteren Kontext die Frage „Ist das, was man über GEO liest, wahr?“ gestellt. ChatGPT und Claude fragten, um welches GEO es sich handele, und keiner von beiden dachte an die Optimierung für generative Suchmaschinen: ChatGPT suchte nach der Glaubwürdigkeit des Magazins GEO, bis hin zu seinem Herausgeber und einem gleichnamigen pakistanischen Nachrichtensender; Claude suchte nach internationalen Organisationen und Berichten, die dieses Kürzel tragen, im Bereich Umwelt und Erdbeobachtung. Gemini antwortete zuerst bezüglich des Magazins und erwähnte dann die Optimierung für generative Suchmaschinen als eine zweite mögliche Bedeutung.
Diese Lektion gilt für jedes Unternehmen. Eine kurze und zweideutige Frage wird in ihrer bekanntesten Bedeutung verstanden, und die zitierten Quellen folgen dieser Interpretation. Aus diesem Grund stützt sich diese Seite auf unsere Messungen der anderen Fragen und nicht auf diese Erhebung: Die zitierten Quellen bezogen sich hauptsächlich auf ein anderes Thema.
Wie man einen GEO-Ratschlag liest
Bevor Sie einem Ratschlag folgen, stellen Sie sich vier Fragen. Für welche KI gilt er, da ChatGPT, Claude und Gemini ihre Quellen nicht auf dieselbe Weise auswählen? Für welche Art von Frage, da eine Frage, die eine Marke nennt, nicht wie eine Marktfrage behandelt wird? Was wurde gemessen: ein Anteil der Zitate, ein Anteil der Antworten, eine Korrelation oder ein Effekt mit einer Kontrollgruppe? Und wurde die Messung wiederholt, da sich die Antworten von Mal zu Mal ändern?
Ein Ratschlag, der keine dieser Fragen beantwortet, ist eine Meinung. Ein Ratschlag, der sie beantwortet, kann nützlich sein, vorausgesetzt, man wendet ihn nicht über das hinaus an, was er gemessen hat.
Was wir nicht wissen
Unsere Messungen beziehen sich auf die API von GPT-5, Claude Sonnet 4.6 und Gemini 3.5 Flash mit Websuche, nicht auf deren Anwendungen oder auf die AI Overviews von Google. Wir haben keine Optimierungsrezepte auf einer Seite getestet: Wir beobachten, was die zitierten Seiten von den ausgeschlossenen Seiten unterscheidet.
Quellen
- Aggarwal et al. — „GEO: Generative Engine Optimization“, KDD 2024, .
- Puerto et al. — „C-SEO Bench: Does Conversational SEO Work?“, NeurIPS 2025, .
- Ahrefs, Louise Linehan — Hinzufügen strukturierter Daten und KI-Zitate, .
- Ahrefs, Louise Linehan — „Why ChatGPT cites pages“, .
- Profound, Nick Lafferty — „AI platform citation patterns“, .
- Ahrefs, Louise Linehan — Zitate aus den AI Overviews und Top 10, .
- Ahrefs, Louise Linehan — Überschneidung zwischen KI-Suche und Top 10, .
- Google Search Central — „Optimizing your website for generative AI features on Google Search“, .
- Messungen von FaireDuBruit vom 4. bis 16. September 2026 — siehe „Wie wir gemessen haben“.