---
title: "Wie KI-Suchmaschinen Quellen zitieren: ChatGPT, Perplexity, Gemini, Claude"
description: "Aus welchen Indizes ChatGPT, Perplexity, Gemini und Claude zitieren, welche Domains dominieren und welche Änderungen die Sichtbarkeit um bis zu 40 % steigern."
lang: de
canonical: https://upgradepro.eu/de/blog/how-ai-engines-cite
published: 2026-07-16
tags: ["GEO", "Inhalte"]
---

# Wie KI-Suchmaschinen Quellen zitieren: ChatGPT, Perplexity, Gemini, Claude

> Aus welchen Indizes ChatGPT, Perplexity, Gemini und Claude zitieren, welche Domains dominieren und welche Änderungen die Sichtbarkeit um bis zu 40 % steigern.

KI-Suchmaschinen zitieren Quellen in zwei Schritten: erst Abruf aus dem Index, dann Auswahl der Passage. Der Index unterscheidet sich je Engine — der eigene Google-Index für AI Overviews und Gemini, der proprietäre Perplexity-Index mit mehr als 200 Milliarden URLs, Suchanbieter von Drittanbietern plus OAI-SearchBot bei ChatGPT und, so die öffentliche Beweislage, Brave Search bei Claude. Die Auswahl bevorzugt danach Seiten mit zitierfähigen Statistiken, direkten Zitaten und klaren Quellenangaben. Google-Rankings allein genügen nicht: Nur 12 % der von KI zitierten URLs stehen zum selben Prompt in den Google-Top-10.

## Warum ist es wichtig, wie KI-Suchmaschinen ihre Quellen auswählen?

Zitate sind der einzige Kanal, über den KI-Antworten Leserinnen und Leser samt Attribution auf Ihre Website zurückschicken. Attribution ist wertvoll genug, dass OpenAI dafür zahlt: Laut [OpenAI](https://openai.com/index/global-news-partnerships-le-monde-and-prisa-media/) (März 2024) bringen die Content-Vereinbarungen mit Verlagen wie AP, Axel Springer, Financial Times, GEDI (La Repubblica, La Stampa), Le Monde, News Corp, Prisa Media (El País), Reuters, Time und Vox Media deren Inhalte als Zusammenfassungen in ChatGPT — "mit Attribution und erweiterten Links zu den Originalartikeln".

Auch die Klicks, die tatsächlich ankommen, verhalten sich womöglich anders. Laut [Google Search Central](https://developers.google.com/search/docs/appearance/ai-features) sind Klicks von Ergebnisseiten mit AI Overviews hochwertiger, das heißt: Nutzerinnen und Nutzer verbringen tendenziell mehr Zeit auf der Website. Das ist Googles eigene Aussage über die eigene Funktion — sie passt aber dazu, warum der Zitatanteil heute eine Kennzahl ist, die neben Rankings verfolgt gehört.

## Welchen Suchindex nutzt welche KI-Suchmaschine?

Vier Engines, drei unterschiedliche Retrieval-Stacks und eine begründete Vermutung. Wer weiß, welcher Index eine Engine speist, weiß auch genau, welcher Crawler Ihre Seiten erreichen können muss.

### ChatGPT: Drittanbieter-Suche plus eigener Crawler

Die ChatGPT-Suche startete am 31. Oktober 2024. Laut der [Ankündigung von OpenAI](https://openai.com/index/introducing-chatgpt-search/) nutzt sie Suchanbieter von Drittanbietern — historisch Bing — sowie Inhalte, die Partnerverlage direkt bereitstellen. Die aktuelle OpenAI-Seite nennt keinen Anbieter mehr; behandeln Sie Bing daher als historischen Ursprung, nicht als bestätigten Ist-Zustand.

Zusätzlich trennt die [Bot-Dokumentation](https://developers.openai.com/api/docs/bots) von OpenAI drei Crawler mit klar getrennten Aufgaben: OAI-SearchBot betreibt die Suche in ChatGPT und entscheidet, welche Websites in den Ergebnissen erscheinen; ChatGPT-User führt nutzerausgelöste Besuche aus; GPTBot sammelt Inhalte für das Modelltraining. Eine Website, die OAI-SearchBot in der robots.txt blockiert, taucht in den Suchantworten von ChatGPT nicht auf.

### Perplexity: eigener Index, gebaut zum Zitieren von Fragmenten

Perplexity betreibt einen eigenen Crawler, PerplexityBot, der laut [offizieller Dokumentation](https://docs.perplexity.ai/guides/bots) ausschließlich dazu dient, Websites in den Ergebnissen sichtbar zu machen und zu verlinken — er wird nicht zum Sammeln von Inhalten für das Training von Foundation Models eingesetzt. Ein separater Agent, Perplexity-User, übernimmt nutzerausgelöste Besuche und kann die robots.txt ignorieren.

Der Maßstab ist für ein Start-up ungewöhnlich: Laut einem [Artikel von Perplexity Research](https://research.perplexity.ai/articles/architecting-and-evaluating-an-ai-first-search-api) (15. Juli 2026) erfasst die Suchinfrastruktur mehr als 200 Milliarden einzelne URLs, kombiniert lexikalisches und semantisches Retrieval und behandelt Dokumentabschnitte und Fragmente als eigenständige Einheiten, damit die Engine die kleinstmögliche Passage zitieren kann. Die praktische Folge: In sich geschlossene Abschnitte, die je eine Frage beantworten, sind genau das, was dieses Retrieval-Design belohnt.

### Gemini und AI Overviews: Google-Index plus Query Fan-out

Google ist bei den Zugangsvoraussetzungen ungewöhnlich deutlich.

> "Es gibt keine zusätzlichen Anforderungen, um in AI Overviews oder AI Mode zu erscheinen, und auch keine weiteren speziellen Optimierungen sind nötig."
> — [Google Search Central, AI Features and Your Website](https://developers.google.com/search/docs/appearance/ai-features) (abgerufen im Juli 2026)

Indexiert und snippet-fähig zu sein ist die gesamte Eintrittskarte. AI Overviews und AI Mode wenden anschließend eine Technik an, die Google Query Fan-out nennt: mehrere verwandte Suchanfragen über Unterthemen und Datenquellen hinweg, was laut Google eine breitere und vielfältigere Auswahl an Links zutage fördert als die klassische Suche. Eine weitere Unterscheidung zählt: Google-Extended steuert, ob Ihre Inhalte Gemini trainieren oder groundieren — es steuert nicht das Erscheinen in den KI-Funktionen der Suche.

### Claude: die Spur zu Brave Search

Anthropic hat seinen Suchanbieter nie benannt. Die Indizien weisen auf Brave Search: [TechCrunch berichtete](https://techcrunch.com/2025/03/21/anthropic-appears-to-be-using-brave-to-power-web-searches-for-its-claude-chatbot/) (21. März 2025), dass Anthropic Brave Search in die Liste der Unterauftragsverarbeiter aufnahm und der Code der Funktion einen Parameter `BraveSearchParams` enthielt; TechCrunch fand zudem mindestens eine Suche, bei der Claude und Brave identische Zitate lieferten. Anthropic selbst betreibt laut [Help Center](https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler) drei separat blockierbare Crawler: ClaudeBot (Training), Claude-User (nutzerausgelöste Besuche) und Claude-SearchBot (Qualität der Suchergebnisse).

## Welche Domains zitieren KI-Suchmaschinen am häufigsten?

Wikipedia steht in der Top-Liste aller drei großen Plattformen und ist bei ChatGPT die Nummer eins (16,3 %), auch wenn Ahrefs YouTube bei Perplexity und AI Overviews darüber misst. Jede Engine pflegt ihre eigene Quellendiät. [Ahrefs](https://ahrefs.com/blog/top-10-most-cited-domains-ai-assistants/) (11. Juni 2025) analysierte 78,6 Millionen Interaktionen mit Daten aus Juni 2025:

| Domain | ChatGPT | Perplexity | Google AI Overviews |
|---|---|---|---|
| Wikipedia | 16,3 % | 12,5 % | 8,4 % |
| YouTube | — | 16,1 % | 9,5 % |
| Reddit | — | — | 7,4 % |
| Quora | — | — | 3,6 % |
| Reuters | 4 % | — | — |

Anteil der Erwähnungen in der Ahrefs-Studie; "—" bedeutet, dass die Domain in der Top-Liste dieser Plattform nicht hervorstach. Die Neigung von ChatGPT zu Nachrichtenmedien wie Reuters passt zu den Verlagsvereinbarungen von OpenAI; AI Overviews ist von den dreien die einzige Plattform, bei der Foren — Reddit und Quora — in die Spitze vorstoßen.

[Profound](https://www.tryprofound.com/blog/ai-platform-citation-patterns) (Juni 2025, aktualisiert August 2025) maß 680 Millionen Zitate von August 2024 bis Juni 2025 und fand dasselbe Muster in anderen Größenordnungen: Wikipedia ist mit 7,8 % aller Zitate die Nummer-eins-Quelle von ChatGPT, Reddit führt bei Perplexity (6,6 %) und bei Google AI Overviews (2,2 %), .com-Domains vereinen 80,41 % der Zitate auf sich und .org-Domains 11,29 %.

Warum sind sich Ahrefs und Profound beim Wikipedia-Anteil für ChatGPT uneinig (16,3 % gegenüber 7,8 %)? Unterschiedliche Methoden, Kennzahlen und Zeiträume. Keine der beiden Zahlen ist falsch; jede gilt nur innerhalb ihrer eigenen Studie. Wer Ihnen als Anbieter einen einzelnen "Anteil an KI-Zitaten" nennt, ohne die Studie zu benennen, verkauft Ihnen Rauschen.

## Wie stabil sind diese Zitiermuster?

Wenig stabil — zumindest bei ChatGPT. [Semrush](https://www.semrush.com/blog/most-cited-domains-ai/) (10. November 2025) verfolgte zwischen dem 14. Juli und dem 12. Oktober 2025 mehr als 230.000 Prompts und über 100 Millionen Zitate. Reddit fiel von rund 60 % der ChatGPT-Antworten auf rund 10 % bis Mitte September 2025, Wikipedia von etwa 55 % auf unter 20 %. Google AI Mode blieb im selben Zeitraum stabil, mit LinkedIn (~15 %) an der Spitze.

Die Lehre für ein KMU: Eine Momentaufnahme über einen Monat, wer zitiert wird, ist keine Strategie. Zitatanteile bei ChatGPT können sich binnen Wochen um Dutzende Punkte verschieben — jede ernsthafte Anstrengung braucht deshalb wiederholte Messung: eine Baseline, eine Maßnahme und ein Nachher.

## Garantieren gute Google-Rankings KI-Zitate?

Nein. Ahrefs untersuchte [15.000 Long-Tail-Suchanfragen](https://ahrefs.com/blog/ai-search-overlap/) (11. August 2025) und stellte fest, dass nur 12 % der von KI-Assistenten zitierten URLs zum ursprünglichen Prompt in den Google-Top-10 ranken.

> "80 % dieser Zitate ranken bei Google für die ursprüngliche Anfrage überhaupt nicht."
> — Ahrefs, Studie zur Überschneidung von KI-Suche und Google (August 2025)

Die Überschneidung variiert je Engine: Perplexity liegt Google mit 28,6 % am nächsten, ChatGPT bewegt sich um 8 %. Bestehende Rankings übertragen sich also etwas auf Perplexity und kaum auf ChatGPT. Diese Lücke ist das praktische Argument dafür, [GEO als eigene Disziplin neben dem klassischen SEO](/de/blog/geo-vs-seo) zu behandeln: Beide Kanäle belohnen Arbeit, die sich überlappt, aber nicht deckt — und der eine erkauft den anderen nicht automatisch.

## Welche inhaltlichen Änderungen erhöhen die Zitierwahrscheinlichkeit wirklich?

Die belastbarste kontrollierte Evidenz bleibt das wissenschaftliche GEO-Paper ([Aggarwal et al., KDD 2024](https://arxiv.org/abs/2311.09735)), getestet auf GEO-bench, einem Benchmark mit 10.000 Suchanfragen. Es zeigt, dass optimierte Inhalte die Sichtbarkeit in generativen Suchmaschinen um bis zu 40 % steigern können. Eine Nuance, die in Zusammenfassungen meist verloren geht: Diese 40 % werden am Position-Adjusted Word Count gemessen — daran, wie viel der Antwort Sie zitiert und wie prominent —, nicht an Klicks oder Traffic.

Laut dem [Volltext](https://ar5iv.labs.arxiv.org/html/2311.09735) waren die wirksamsten Taktiken:

1. Direkte Zitate aus Quellen ergänzen: rund 27,8 % Verbesserung.
2. Statistiken ergänzen: rund 25,9 %.
3. Quellen zitieren: rund 24,9 %.
4. Die sprachliche Qualität des Textes verbessern: rund 25,1 %.

Keyword-Stuffing — der Reflex des alten SEO — funktionierte nicht. Und die Verteilung der Zugewinne sollten kleine Unternehmen zweimal lesen: Die am schlechtesten platzierten Seiten gewannen am meisten, bis zu +115 % Sichtbarkeit. Generative Antworten verteilen Aufmerksamkeit nach unten um — genau deshalb lohnt es sich zu lernen, [was Inhalte zitierfähig macht](/de/blog/citable-content), bevor Ihre größeren Wettbewerber es tun.

## Sollten Sie KI-Crawler in der robots.txt erlauben oder blockieren?

Trennen Sie Such-Bots von Trainings-Bots — es sind unterschiedliche User-Agents mit unterschiedlichen Folgen.

| Unternehmen | Suche / Zitate | Nutzerausgelöste Besuche | Training |
|---|---|---|---|
| OpenAI | OAI-SearchBot | ChatGPT-User | GPTBot |
| Perplexity | PerplexityBot | Perplexity-User (kann robots.txt ignorieren) | — (laut Doku nicht für Foundation Models) |
| Anthropic | Claude-SearchBot | Claude-User | ClaudeBot |
| Google | Googlebot (Index + KI-Funktionen) | — | Google-Extended (Gemini-Training/Grounding) |

Wer OAI-SearchBot blockiert, verschwindet aus den Suchantworten von ChatGPT; wer GPTBot oder ClaudeBot blockiert, steigt lediglich aus dem Training aus, ohne die Präsenz in zitierten Antworten anzutasten. Auf Google-Seite begrenzen die klassischen Steuerelemente — noindex, nosnippet, data-nosnippet, max-snippet — ebenfalls Ihre Darstellung in den KI-Funktionen, während Google-Extended nur Training und Grounding von Gemini regelt. User-Agent-Strings und robots.txt-Beispiele zum Kopieren finden Sie in unserem [Leitfaden zu KI-Crawlern](/de/blog/ai-crawlers-guide).

## Was sollte ein KMU diese Woche tun?

Fünf Maßnahmen, alle ohne Toolkauf umsetzbar:

1. **robots.txt prüfen.** Stellen Sie sicher, dass OAI-SearchBot, PerplexityBot, Claude-SearchBot und Googlebot erlaubt sind. Über GPTBot und ClaudeBot entscheiden Sie getrennt — das ist eine Frage der Trainingszustimmung, keine Sichtbarkeitsfrage.
2. **Snippet-Fähigkeit bei Google kontrollieren.** Suchen Sie nach ungewollten noindex-, nosnippet- oder max-snippet-Direktiven; laut Google sind Indexierung plus Snippet-Fähigkeit die einzige Zugangsvoraussetzung für AI Overviews.
3. **Ihre fünf wichtigsten Seiten aufwerten** — mit belegten Statistiken, direkten Zitaten und expliziten Quellenangaben: die drei Taktiken mit rund 25–28 % gemessenem Zugewinn im GEO-Paper.
4. **Abschnitte in sich geschlossen halten.** Überschriften als Frage, mit der direkten Antwort in den ersten Sätzen, weil das Retrieval von Perplexity Fragmente als eigenständige Zitiereinheiten behandelt.
5. **Eine Baseline festhalten.** Führen Sie Ihre 10 bis 20 zentralen Kaufprompts monatlich auf ChatGPT, Perplexity und Google aus und protokollieren Sie, welche Domains zitiert werden; Semrush zeigte, dass sich diese Anteile binnen Wochen um Dutzende Punkte verschieben können.

Wenn Sie diese Baseline gemessen und ehrlich etikettiert haben möchten — was gemessen, was berechnet und was angenommen ist —, liefert genau das unser [Audit der KI-Sichtbarkeit](/de/services/ai-visibility).

## Häufige Fragen

### Welchen Suchindex nutzt welche KI-Suchmaschine?

ChatGPT kombiniert Suchanbieter von Drittanbietern (historisch Bing), den eigenen Crawler OAI-SearchBot und Inhalte von Partnerverlagen. Perplexity baut und betreibt einen eigenen Index und erfasst mit PerplexityBot mehr als 200 Milliarden einzelne URLs. Gemini und AI Overviews greifen auf den Google-Index zu. Claude stützt sich mit hoher Wahrscheinlichkeit auf Brave Search: Anthropic führte Brave im März 2025 als Unterauftragsverarbeiter, hat die Zusammenarbeit aber nie offiziell bestätigt.

### Brauche ich spezielles Markup oder eine spezielle Datei für Google AI Overviews?

Nein. Google hält in der offiziellen Dokumentation fest, dass es keine zusätzlichen Anforderungen und kein spezielles Schema gibt: Ihre Seite muss indexiert und für ein Snippet in der Suche zugelassen sein. Die klassischen Steuerelemente nosnippet, data-nosnippet, max-snippet und noindex begrenzen ebenso Ihre Darstellung in den KI-Funktionen.

### Werde ich von KI-Suchmaschinen zitiert, wenn ich bei Google auf Platz eins stehe?

Nicht zwingend. Laut einer Ahrefs-Studie zu 15.000 Long-Tail-Suchanfragen ranken nur 12 % der von KI-Assistenten zitierten URLs in den Google-Top-10 zum selben Prompt, und 80 % der Zitate ranken bei Google für die ursprüngliche Anfrage überhaupt nicht. Perplexity liegt Google mit 28,6 % Überschneidung am nächsten, ChatGPT bei rund 8 %.

### Welche Websites zitieren KI-Suchmaschinen am häufigsten?

Wikipedia, YouTube und Reddit dominieren, doch jede Plattform hat ihr eigenes Muster: ChatGPT bevorzugt Wikipedia und Nachrichtenmedien (OpenAI hat Content-Vereinbarungen mit mehreren Verlagen), Perplexity bevorzugt YouTube und Reddit, und Google AI Overviews gibt Foren wie Reddit und Quora mehr Raum. Diese Anteile sind volatil: Semrush maß, wie Reddit innerhalb weniger Wochen von rund 60 % auf rund 10 % der ChatGPT-Antworten fiel.

### Welche konkreten inhaltlichen Änderungen erhöhen die Zitierwahrscheinlichkeit?

Das wissenschaftliche GEO-Paper (KDD 2024) zeigt, dass optimierte Inhalte die Sichtbarkeit in generativen Suchmaschinen um bis zu 40 % steigern können. Gemessen wurde am Position-Adjusted Word Count, also daran, wie viel der Antwort Sie zitiert und wie prominent, nicht an Klicks oder Traffic. Am wirksamsten waren direkte Zitate aus Quellen (rund 27,8 % Verbesserung), Statistiken (rund 25,9 %), Quellenangaben (rund 24,9 %) und bessere sprachliche Qualität (rund 25,1 %). Klassisches Keyword-Stuffing wirkte nicht. Schlechter platzierte Seiten gewannen am meisten, bis zu +115 % Sichtbarkeit.

### Soll ich KI-Bots in der robots.txt erlauben oder blockieren?

Trennen Sie Suche von Training. Wenn Sie zitiert werden wollen, erlauben Sie die Such-Bots: OAI-SearchBot von OpenAI, PerplexityBot, Claude-SearchBot und Googlebot. Wer OAI-SearchBot blockiert, verschwindet aus den Suchantworten von ChatGPT. Die Trainings-Bots GPTBot und ClaudeBot lassen sich unabhängig davon blockieren, ohne Sichtbarkeit in zitierten Antworten zu verlieren.

## Quellen

Jede Aussage in diesem Artikel verweist auf die Quelle, aus der sie stammt, mit ihrem Veröffentlichungsdatum.

- [OpenAI — Bots and crawlers documentation](https://developers.openai.com/api/docs/bots) — 2026-07-16
- [OpenAI — Introducing ChatGPT search](https://openai.com/index/introducing-chatgpt-search/) — 2024-10-31
- [OpenAI — Global news partnerships: Le Monde and Prisa Media](https://openai.com/index/global-news-partnerships-le-monde-and-prisa-media/) — 2024-03-13
- [Perplexity — Crawlers documentation](https://docs.perplexity.ai/guides/bots) — 2026-07-16
- [Perplexity Research — Architecting and Evaluating an AI-First Search API](https://research.perplexity.ai/articles/architecting-and-evaluating-an-ai-first-search-api) — 2026-07-15
- [Google Search Central — AI Features and Your Website](https://developers.google.com/search/docs/appearance/ai-features) — 2026-07-16
- [Anthropic — Claude Help Center: web crawlers](https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler) — 2026-07-16
- [TechCrunch — Anthropic appears to be using Brave to power web searches for Claude](https://techcrunch.com/2025/03/21/anthropic-appears-to-be-using-brave-to-power-web-searches-for-its-claude-chatbot/) — 2025-03-21
- [Ahrefs — The 10 Most Mentioned Domains for ChatGPT, Perplexity, and AI Overviews](https://ahrefs.com/blog/top-10-most-cited-domains-ai-assistants/) — 2025-06-11
- [Ahrefs — AI search overlap study](https://ahrefs.com/blog/ai-search-overlap/) — 2025-08-11
- [Semrush — The Most-Cited Domains in AI: A 3-Month Study](https://www.semrush.com/blog/most-cited-domains-ai/) — 2025-11-10
- [Profound — AI Platform Citation Patterns](https://www.tryprofound.com/blog/ai-platform-citation-patterns) — 2025-06-05
- [Aggarwal et al. — GEO: Generative Engine Optimization (arXiv 2311.09735)](https://arxiv.org/abs/2311.09735) — 2023-11-16
- [Aggarwal et al. — GEO: Generative Engine Optimization (full text, ar5iv — v3, June 2024)](https://ar5iv.labs.arxiv.org/html/2311.09735) — 2024-06-28
