Studie
Sechs KI-Engines, eine Frage, kaum gemeinsame Quellen
Gründer von Epovest
Gemessen vom 27.07.2026 bis zum 14.08.2026 KI-Engines: ChatGPT, Claude, Gemini, Perplexity, Mistral, Grok
Vorherige Ausgabe: Was KI-Assistenten wirklich zitieren: die Website-Profile hinter den Antworten, Engine für Engine
Stellen Sie sechs KI-Assistenten am selben Tag dieselbe Frage, und jeder nennt Quellen zur Stützung seiner Antwort. Man stellt sie sich gern aus einem gemeinsamen Fundus maßgeblicher Seiten schöpfend vor, den jede Engine nur etwas anders sortiert. Wir haben gemessen, was sie tatsächlich gemeinsam haben, Frage für Frage: Zwei Engines teilen im Schnitt 6,4 % ihrer Quellen, und kein Paar der sechs erreicht 13 %.
Diese Zahl ändert das Wesen einer Sichtbarkeitsstrategie. Schöpften die Engines aus einem gemeinsamen Fundus, wäre Zitiertwerden ein einziger Wettbewerb auf sechs Anzeigetafeln. So ist es nicht: Es sind sechs Wettbewerbe, und eine Seite kann mehrere davon gewinnen, ohne dort je zweimal denselben Konkurrenten zu begegnen.
Die Messung
Zwischen dem 27. Juli und dem 14. August 2026 stellten unsere Tracker sechs Engines feste Fragenpanels über ihre offiziellen APIs, in sechs Sprachen: 2.883 Antworten, archiviert mit jeder ihrer Quellen, 22.229 Zitate insgesamt. Mistral und Grok kamen Ende Juli in den gemessenen Katalog und werden hier zum ersten Mal gelesen, neben ChatGPT, Claude, Gemini und Perplexity.
Engines zu vergleichen verlangt eine paarbare Einheit, und ein Gesamtwert pro Engine ist keine: Zwei Engines, die völlig verschiedene Seiten zitieren, und zwei Engines, die dieselben Seiten zitieren, ergeben dieselben Summen. Der Vergleich steigt deshalb hinab zur Zelle, also einer Frage, gestellt in einer Erhebung, bei einer bestimmten Wiederholung. Innerhalb einer Zelle wurden die Engines im selben Moment nach demselben gefragt, und genau das macht den Vergleich legitim. Für jede Zelle nehmen wir die Menge der registrierbaren Domains, die jede Engine zitiert hat, und messen den Anteil ihrer zusammengelegten Quellen, den beide genannt haben. Zellen, in denen beide Engines nichts zitiert haben, werden gesondert gezählt und fallen aus dem Mittelwert, denn dort gibt es nichts zu teilen.
Befund 1: kein Engine-Paar teilt mehr als 13 % seiner Quellen
Jedes Paar trägt seinen eigenen Nenner, von 237 bis 519 vergleichbaren Zellen:
- Claude und Mistral12,6 %
- Gemini und Perplexity11,4 %
- Grok und Perplexity10,1 %
- Gemini und Grok10,0 %
- Gemini und Mistral7,4 %
- Mistral und Perplexity7,1 %
- Grok und Mistral6,9 %
- Claude und Gemini4,7 %
- Claude und Perplexity4,6 %
- ChatGPT und Grok4,6 %
- Claude und Grok4,1 %
- ChatGPT und Gemini3,5 %
- ChatGPT und Mistral3,1 %
- ChatGPT und Perplexity2,9 %
- ChatGPT und Claude2,3 %
Datentabelle anzeigen
| Engine-Paar | Geteilte Quellen |
|---|---|
| Claude und Mistral | 12,6 % |
| Gemini und Perplexity | 11,4 % |
| Grok und Perplexity | 10,1 % |
| Gemini und Grok | 10,0 % |
| Gemini und Mistral | 7,4 % |
| Mistral und Perplexity | 7,1 % |
| Grok und Mistral | 6,9 % |
| Claude und Gemini | 4,7 % |
| Claude und Perplexity | 4,6 % |
| ChatGPT und Grok | 4,6 % |
| Claude und Grok | 4,1 % |
| ChatGPT und Gemini | 3,5 % |
| ChatGPT und Mistral | 3,1 % |
| ChatGPT und Perplexity | 2,9 % |
| ChatGPT und Claude | 2,3 % |
Acht der fünfzehn Paare liegen unter 5 %. Die zwei nächstliegenden Engines des Sets, Claude und Mistral, behalten noch immer sieben von acht Quellen für sich. Und die zwei Engines, die ein Marketingteam am ehesten als austauschbar behandelt, ChatGPT und Claude, stehen am weitesten auseinander: Bei denselben Fragen sind 2,3 % der Quellen, die sie nennen, dieselben.
Befund 2: das Ergebnis hielt einen Monat später, auf einem dreimal größeren Korpus
Eine einzelne Messung kann ein Zufall ihres Fensters sein. Wir haben dasselbe Instrument über unsere Julimessung laufen lassen, die vier Engines und ein Drittel der Antworten umfasste, und die sechs in beiden Wellen messbaren Paare bewegten sich kaum:
- Juli
- August
- Gemini und Perplexity12,1 %11,4 %
- Claude und Perplexity3,2 %4,6 %
- Claude und Gemini3,1 %4,7 %
- ChatGPT und Gemini3,0 %3,5 %
- ChatGPT und Perplexity2,0 %2,9 %
- ChatGPT und Claude1,5 %2,3 %
Datentabelle anzeigen
| Engine-Paar | Juli | August |
|---|---|---|
| Gemini und Perplexity | 12,1 % | 11,4 % |
| Claude und Perplexity | 3,2 % | 4,6 % |
| Claude und Gemini | 3,1 % | 4,7 % |
| ChatGPT und Gemini | 3,0 % | 3,5 % |
| ChatGPT und Perplexity | 2,0 % | 2,9 % |
| ChatGPT und Claude | 1,5 % | 2,3 % |
Das Korpus verdreifachte sich, aus zwei Sprachen wurden sechs, und die Obergrenze blieb, wo sie war. Was diese Engines trennt, ist demnach eine Eigenschaft dessen, wie jede abruft und auswählt, und nicht eine Besonderheit von zwei Fragewochen.
Befund 3: das meiste, was eine Engine zitiert, zitiert sie allein
Das Teilen hat eine mechanische Obergrenze, wenn zwei Engines unterschiedlich viel zitieren: Perplexity nennt 16,5 Quellen je Antwort mit Quellen und Claude 4,6, sodass ihre Überschneidung selbst dann 28 % anzeigen würde, wenn jede von Claude genannte Quelle auch bei Perplexity stünde. Eine zweite Messung entgeht dieser Obergrenze vollständig, indem sie eine andere Frage stellt: Welchen Anteil der Quellen, die eine Engine in einer Zelle zitiert, zitiert dort keine andere Engine?
- ChatGPT75,6 %
- Perplexity73,5 %
- Gemini62,0 %
- Grok45,3 %
- Claude44,0 %
- Mistral40,6 %
Datentabelle anzeigen
| Engine | Quellen, die sie allein zitiert |
|---|---|
| ChatGPT | 75,6 % |
| Perplexity | 73,5 % |
| Gemini | 62,0 % |
| Grok | 45,3 % |
| Claude | 44,0 % |
| Mistral | 40,6 % |
Drei Viertel dessen, was ChatGPT zitiert, zitiert keine der anderen fünf zur selben Frage. Selbst Mistral, die konsensfähigste der sechs, bringt vier von zehn Quellen ein, die sonst niemand einbringt. Von einer Engine gelesen zu werden sagt sehr wenig über die anderen fünf, und das zeigen beide Instrumente zugleich.
Befund 4: sie zitieren verschieden, weil sie verschieden lesen
Die Profile hinter diesen Abständen sind stabil, und jedes erklärt einen Teil davon:
- ChatGPT neigt zum Institutionellen: Lonely Planet, National Geographic, die UNESCO, Tripadvisor und Wikipedia führen seine Quellen an, und YouTube fehlt in seinen Top 100.
- Perplexity liest zuerst die Plattformen: YouTube und Reddit tragen zusammen 10,9 % seiner Zitate, vor LinkedIn und Facebook. Was es auf YouTube liest, ist das Transkript.
- Gemini streut am breitesten: 5.124 Zitate auf 2.318 Domains, wo spezialisierte Anbieter und persönliche Blogs die Spitze mit Reddit teilen.
- Claude bearbeitet den Long Tail: seine meistzitierte Domain trägt 1,1 % seiner Zitate, dahinter folgen signierte Expertenseiten. Es liest zudem weit mehr, als es zeigt, mit 1.497 gelesenen, aber nicht zitierten Seiten.
- Grok ankert auf Foren und beruflichen Netzwerken: Reddit zuerst, dann Semrush, LinkedIn und Malt.
- Mistral zitiert ein kleines Web aus Nischen- und Bewertungsseiten: 542 Domains, angeführt von Fachseiten und Trustpilot.
Die Abrufgewohnheit macht den Rest: Perplexity suchte bei 100 % seiner Antworten, Grok bei 98,2 % und Gemini bei 95,6 %, gegenüber ChatGPT 70,9 %, Mistral 60,6 % und Claude 50,7 %. Wo eine Engine nicht sucht, antwortet das Trainingskorpus, und dieses Korpus wurde vor Monaten eingefroren.
Was das für eine Marke ändert
- Lesen Sie Ihre Sichtbarkeit pro Engine, und handeln Sie pro Engine. Ein Mittelwert über sechs Engines beschreibt keine davon, denn ihre Quellenmengen überschneiden sich kaum. Darauf ist unsere Methode gebaut, und deshalb sagt ein Suchranking keine Präsenz in den Antworten mehr voraus.
- Eine Lücke auf einer Engine ist eine eigene Aufgabe. ChatGPT über institutionelle Register und Presse zu gewinnen bringt nichts für Grok, wo Foren und berufliche Netzwerke die Antwort tragen. Wenn ein Wettbewerber die Antwort hält, die Sie wollten, steht er in den Quellen, die diese Engine liest, und die Korrektur ist die eigene Quellenmenge dieser Engine.
- Sechs nahezu disjunkte Mengen sind sechs Öffnungen. Eine bescheidene Seite kann in die zitierte Menge einer Engine eintreten, ohne gegen alles anzutreten, was die anderen fünf bereits belegt. Zu messen, welche Engines Sie zitieren und welche Sie lesen, ohne Sie zu zitieren, ist eine Aufgabe für sich, und Claude kann die Lesearbeit übernehmen.
Methode
2.883 Antworten, erhoben zwischen dem 2026-07-27 und dem 2026-08-14 von Epovest-Trackern über die offiziellen APIs der Engines, auf festen Panels, formuliert, wie Kunden sie stellen, in sechs Sprachen. Die Überschneidung wird Zelle für Zelle gemessen, wobei eine Zelle eine Frage in einer Erhebung bei einer bestimmten Wiederholung ist, sodass die gepaarten Engines im selben Moment nach demselben gefragt wurden. Quellen werden als Mengen registrierbarer Domains gezählt, nur Zitate: Seiten, die gelesen, aber nicht zitiert wurden, bleiben ausgeschlossen, da eine einzige Engine sie offenlegt. Jedes Paar wird auf den Zellen gemessen, in denen beide Engines geantwortet haben, von 237 bis 519 Zellen, sodass eine zusätzliche Engine im Katalog die bestehenden Paare unverändert lässt. Zellen, in denen beide nichts zitiert haben, werden gesondert gezählt. Diese Welle ersetzt die Julimessung, die verfügbar bleibt. Zahlen dürfen mit Quellenangabe weiterverwendet werden.