Studie
Was KI-Assistenten wirklich zitieren: die Website-Profile hinter den Antworten, Engine für Engine
Wenn eine KI die Frage Ihres Marktes beantwortet, auf welchen Seiten steht diese Antwort? Die Namen, die einem einfallen, sind die großen: etablierte Medien, Plattformen, die jeder kennt. Wäre das wahr, stünde die Tür für alle anderen bereits zu. Also haben wir es gemessen, auf unseren eigenen Panels: 923 Antworten, archiviert mit jeder zitierten Quelle, über vier Engines und fünf Märkte, im Juli 2026.
Zwei Ergebnisse tragen diese Studie. Das zitierte Web ist deutlich offener, als die Annahme "immer dieselben großen Namen" vermuten lässt. Und jede Engine vertraut einem sichtbar anderen Web: Jede Zahl unten wird deshalb pro Engine angegeben, nie als Durchschnitt.
Die Messung
Zwischen dem 10. und dem 25. Juli 2026 haben unsere Tracker 18 feste Fragenpanels an ChatGPT, Claude, Gemini und Perplexity gestellt, über deren offizielle APIs, genau so, wie sie für jedes Konto laufen. Die Panels decken fünf Märkte ab: Reiseziele (648 Antworten), SaaS und KI-Sichtbarkeit (208), Webdienstleistungen auf Französisch (27), Wechselkursdaten (16) und Fragen zur Markenidentität (24). Jede Antwort wird mit ihren zitierten Quellen archiviert: 6.991 Zitate insgesamt, verteilt auf 2.049 eindeutige Root-Domains.
Reise und SaaS tragen das statistische Gewicht. Die drei kleinen Panels sind als Hinweise zu lesen, nicht als Gesetze, und werden unten entsprechend gekennzeichnet.
Befund 1: Kein Oligopol hält heute die Antworten
Für jede Engine haben wir die Zitate ihrer zehn meistzitierten Domains aufsummiert:
| Engine | Reisefragen | SaaS-Fragen |
|---|---|---|
| ChatGPT | 43 % | 32 % |
| Perplexity | 28 % | 23 % |
| Claude | 25 % | 27 % |
| Gemini | 12 % | 16 % |
Selbst am konzentriertesten Ende (ChatGPT bei Reisen) lassen die zehn ersten Domains 57 % der Zitate allen anderen. Am offenen Ende tragen die zehn meistzitierten Reise-Domains von Gemini 12 % seiner Zitate, und es brauchte 746 verschiedene Domains, um den Rest zu tragen. Die Menge der Seiten, auf denen KI-Antworten stehen, ist ein Long Tail, und bescheidene Websites sind Teil davon.
Befund 2: Jede Engine vertraut einem anderen Web
ChatGPT neigt zum Institutionellen. Bei Reisen sind seine drei meistzitierten Quellen Lonely Planet (129 Zitate), National Geographic (102) und die UNESCO (51), Regierungsdomains folgen dicht dahinter. Seine Messlatte ist eine anderswo aufgebaute Reputation, was es zur langsamsten Menge macht, in die man hineinkommt.
Gemini streut am breitesten. Spezialisierte Veranstalter, persönliche Blogs, YouTube und Reddit teilen sich seine Spitze, und keine Quelle dominiert. Eine fokussierte Website mit einer starken Seite zur exakten Frage kann in seine zitierte Menge eintreten: Hier tauchen Neueinsteiger zuerst auf.
Perplexity liest zuerst die Plattformen. Bei Reisefragen ist YouTube seine meistzitierte Quelle (152 Zitate), Reddit die zweite (138). Dasselbe Muster gilt bei SaaS-Fragen, wo auch LinkedIn unter seine ersten Quellen kommt. Wie wir in unserer YouTube-Studie gemessen haben, ist das, was die Engine dort tatsächlich liest, das Transkript.
Claude zitiert am wenigsten und liest am meisten. 466 Zitate über 233 Antworten, aber allein bei den SaaS-Fragen hat er 342 Seiten gelesen, ohne sie zu zitieren, eine Zahl, die nur Claude offenlegt. Wenn er zitiert, stehen die Antworten auf Blogs unabhängiger Berater und Seiten von Agenturen: Expertise, die von einer Person oder einer Praxis unterzeichnet ist, statt Massenmedien.
Bei den SaaS-Fragen zählt ein weiterer Fakt für jeden Anbieter: Die eigenen Seiten der Tool-Hersteller werden von allen Engines zitiert, neben den Dritten. Die Frage Ihres Marktes auf Ihrer eigenen Seite zu beantworten ist keine verlorene Tinte.
Befund 3: Wenn die Engine nicht sucht, antwortet ihr Gedächtnis
Nicht jede Antwort löst eine Websuche aus. Gemessen auf diesem Korpus: Perplexity suchte in 100 % seiner Antworten, Gemini in 96 %, ChatGPT in 73 %, Claude in 42 %.
Die Zahl von Claude verbirgt das nützlichste Detail: Er sucht je nach Thema. Bei Fragen zu SaaS und KI-Sichtbarkeit suchte er in 79 % der Fälle; bei Reisen in 27 %, und sonst antwortete er aus dem Gedächtnis. Wo die Engine glaubt, es bereits zu wissen, antwortet der Trainingskorpus, und dieser Korpus wurde vor Monaten eingefroren.
Es stecken also zwei verschiedene Spiele in einer einzigen Sichtbarkeitsfrage. Der Live-Abruf belohnt die Seite, die die exakt gestellte Frage beantwortet, und lässt sich diese Woche gewinnen. Der eingefrorene Korpus belohnt, was stabil und wiederholt existierte, als er gebaut wurde, und aktualisiert sich erst mit dem nächsten Modell. Früh veröffentlichen und URLs wie Fakten stabil halten: So spielt eine Marke auf beiden Feldern.
Befund 4: Vertrauensfragen ankern auf bescheidenen Dritten
Unser Panel zur Markenidentität ist klein (24 Antworten, indikativ), aber sein Muster ist scharf und deckt sich mit dem, was wir in unserer Backlink-Studie gemessen haben: Wenn Engines auf "Kann ich diesem Unternehmen vertrauen" antworten, gehen die Zitate an Bewertungsplattformen (Trustpilot zuerst), an LinkedIn und an Register und Verifizierungsseiten Dritter, nicht an die Presse. Die Akte bei Dritten trägt das Urteil, und solche Seiten kann jedes Unternehmen haben.
Was eine Marke daraus macht
- Decken Sie die Fragen Ihres Marktes auf Ihren eigenen Seiten ab. Anbieterseiten werden zitiert, wenn sie die gestellte Frage beantworten, und sie sind die eine Menge von Seiten, die Sie vollständig kontrollieren.
- Existieren Sie dort, wo jede Engine liest. Ein gut betiteltes Video, dessen Transkript die Frage beantwortet, für Gemini und Perplexity. Eine saubere Akte bei Dritten, für Vertrauensfragen. Von Experten unterzeichnete Seiten, für Claude.
- Messen Sie pro Engine, nie im Durchschnitt. Jede Zahl dieser Studie teilt sich in vier. Eine auf den Durchschnitt eingestellte Strategie optimiert für eine Engine, die es nicht gibt.
Methode
923 Antworten, gesammelt zwischen dem 2026-07-10 und dem 2026-07-25 von Epovest-Trackern über die offiziellen APIs der Engines, auf festen Panels, formuliert, wie Kunden sie stellen. Jede Antwort wird mit ihren zitierten Quellen archiviert; Domains werden auf ihre registrierbare Root normalisiert (2.049 eindeutige Roots). Die Zellgrößen variieren nach Markt und Engine und stehen im Text. Die Zahlen dürfen mit Quellenangabe weiterverwendet werden.