Macht Wikipedia ein Unternehmen in KIs sichtbar?
Veröffentlicht am
Nicht direkt, und nicht für die meisten Unternehmen. Wikipedia hat ein großes Gewicht bei dem, was KI-Modelle lernen, aber eine Wikipedia-Seite für ein Unternehmen wird nur dann zugelassen, wenn die unabhängige Presse bereits über es geschrieben hat, und sie garantiert keineswegs eine Zitierung. In unseren Messungen wurden die von der ChatGPT-Suche bei Fragen zur künstlichen Intelligenz aufgerufenen Wikipedia-Seiten nur in 1,3 % der Fälle zitiert. Wikipedia macht ein Unternehmen in KIs sichtbar, wenn es bereits bekannt ist; sie ersetzt keine Seite, die die Frage Ihres Kunden beantwortet.
Für welche Art von Frage? Alles hängt von der Frage ab. Wenn der Nutzer über Wikipedia spricht, lesen die KIs Wikipedia: Bei der Frage auf dieser Seite hat ChatGPT schließlich die Regeln der Enzyklopädie selbst zitiert. Bei einer Produkt- oder Marktfrage, bei der niemand auf Wikipedia verweist, ist die Enzyklopädie selten die angezeigte Quelle.
Das Gewicht von Wikipedia beim Training von KIs
Wikipedia ist Teil der Trainingsdaten großer Sprachmodelle und hat dort ein Gewicht, das über ihre Größe hinausgeht. In dem Artikel, in dem GPT-3 im Jahr 2020 vorgestellt wurde, schlüsselt OpenAI seinen Datenmix auf: Wikipedia machte nur 3 Milliarden Token und 3 % des Mixes aus, aber das Modell durchlief sie während des Trainings 3,4-mal, verglichen mit 0,44-mal für den gefilterten Common Crawl-Korpus, der immerhin hundertmal größer war. Die Anbieter veröffentlichen diese Details für neuere Modelle nicht mehr.
Die Akteure im KI-Bereich zahlen auch für den Zugriff auf die Daten von Wikipedia. Am 15. Januar 2026 kündigte Wikimedia Enterprise neue Partner an: Amazon, Meta, Microsoft, Mistral AI und Perplexity, die sich unter anderem Google anschließen. Wikipedia ist also eine Wissensquelle für die Modelle und eine Datenquelle für die Suchmaschinen der KIs. Aber was das Modell gelernt hat und was es bei der Beantwortung zitiert, sind zwei verschiedene Dinge.
Wikipedia in Zitaten: Zahlen, die nicht dasselbe messen
Die am häufigsten zitierte Zahl stammt von Profound, einem Unternehmen, das Zitate von ChatGPT, KI-Antworten von Google und Perplexity zwischen August 2024 und Juni 2025 analysiert hat. Wikipedia macht dort 7,8 % aller ChatGPT-Zitate aus. Die Zahl von 47,9 %, die oft als „die Hälfte der ChatGPT-Zitate“ dargestellt wird, ist in Wirklichkeit nur der Anteil von Wikipedia unter den zehn am häufigsten zitierten Domains.
Semrush, das die Antworten von ChatGPT vom 14. Juli bis zum 12. Oktober 2025 verfolgt hat, misst etwas anderes: den Anteil der Antworten, die Wikipedia mindestens einmal zitieren. Dieser sank zwischen August und September 2025 von rund 55 % auf unter 20 %. Ein Anteil an allen Zitaten, ein Anteil unter den Top-Domains und ein Anteil an den Antworten liefern Zahlen, die von eins bis sieben reichen; sie ohne ihre jeweilige Einheit zu vergleichen, führt zu falschen Schlussfolgerungen.
Was wir in Bezug auf Wikipedia gemessen haben
Wir messen für jede Domain den Anteil der durch die Suche einer KI abgerufenen Seiten, die am Ende zitiert werden. Bei ChatGPT wurden bei Fragen zur künstlichen Intelligenz, die größtenteils auf Englisch gestellt wurden, die abgerufenen Wikipedia-Seiten in 1,3 % der Fälle zitiert. Zusammen mit Reddit und YouTube bleiben sie auf all unseren Korpora unter 1,5 %, während die anderen abgerufenen Seiten in 10 bis 15 % der Fälle zitiert werden.
Bei der Frage auf dieser Seite, die am 15. September 2026 gestellt wurde, machte Wikipedia 23 % und dann 27 % der von ChatGPT abgerufenen Ergebnisse aus, und 24 % bzw. 21 % bei Claude. ChatGPT zitierte beim ersten Mal keine Wikipedia-Seite und zitierte sie beim zweiten Mal in 17 % seiner Quellen: den Artikel über die Relevanzkriterien von Wikipedia. Claude zitierte sie in 7 % seiner Quellen für die Relevanzkriterien von Unternehmen. Gemini hat sie weder abgerufen noch zitiert. Wenn sich die Frage auf Wikipedia bezieht, taucht die Enzyklopädie in den Zitaten auf; es ist die Frage, die sie aufruft, nicht die Bekanntheit des Unternehmens.
Kann ein Unternehmen eine eigene Wikipedia-Seite haben?
Die Regeln sind streng. Auf Wikipedia auf Französisch ist ein Artikel über ein Unternehmen nur dann zulässig, wenn bedeutende, unabhängige und veröffentlichte Arbeiten über es verfasst wurden, die im Abstand von mindestens zwei Jahren erschienen sind. Veröffentlichungen aus der Unternehmenskommunikation wie Pressemitteilungen, Nachdrucke von Artikeln oder Werbeanzeigen zählen nicht. Auf Wikipedia auf Englisch wird kein Unternehmen automatisch als zulässig angesehen, unabhängig von seiner Größe.
Das Schreibenlassen einer eigenen Seite gegen Bezahlung ist reglementiert: Der bezahlte Beitrag muss die Identität des Kunden oder Arbeitgebers offenlegen, und werbliche Beiträge bleiben strengstens verboten. Für ein KMU ohne eine über mindestens zwei Jahre verteilte unabhängige Presseberichterstattung ist eine Wikipedia-Seite daher kein verfügbarer Hebel: Sie ist eine Folge von Bekanntheit, kein Mittel, um diese zu erlangen.
Was das für ein Unternehmen ändert
Der Versuch, auf Wikipedia zu gelangen, um in KIs sichtbar zu sein, geht das Problem von der falschen Seite an. Was wir bei ChatGPT beobachten, ist, dass es in seiner Suchanfrage die Namen der Quellen schreibt, die es kennt, und diese bevorzugt zitiert. Ein Name baut sich durch Erwähnungen in unabhängigen Quellen auf, die von KIs konsultiert werden; genau diese Erwähnungen sind übrigens das, was Wikipedia verlangt, um ein Unternehmen aufzunehmen.
Der gangbare Weg besteht also darin, auf Seiten, die von KIs gelesen und zitiert werden, die Fragen zu beantworten, die sich Ihre Kunden stellen, und dort erwähnt zu werden, wo diese Fragen behandelt werden. Eine Wikipedia-Seite kann danach kommen, wenn die Presse folgt; sie geht der Sichtbarkeit nicht voraus.
Was wir nicht wissen
Unsere Messungen beziehen sich auf die API der Modelle, nicht auf die Benutzeroberfläche von ChatGPT, Claude oder Gemini. Wir messen nicht die Auswirkung einer Wikipedia-Seite für ein Unternehmen auf seine Zitate in KIs; auch keine der von uns gelesenen veröffentlichten Studien misst dies.
Quellen
- Brown et al., OpenAI — „Language Models are Few-Shot Learners“ (GPT-3), Tabelle 2.2, .
- Wikimedia Enterprise — angekündigte Partner zum 25-jährigen Jubiläum von Wikipedia, .
- Profound, Nick Lafferty — „AI platform citation patterns“, .
- Semrush, Luke Harsel — die von KIs am häufigsten zitierten Domains, .
- Wikipedia — Relevanz von Unternehmen, Gesellschaften und Produkten, .
- Wikipedia — Bezahlte Beiträge, .
- Messungen von FaireDuBruit vom 4. bis 16. September 2026 — siehe „Wie wir gemessen haben“.