Bei Spam in AI Search gehen die Plattformen weit auseinander: Im Experiment von Otterly.ai sortierte Google zwei Domains mit je rund 1.000 unredigierten KI-Artikeln aus, Copilot, Claude und Perplexity zitierten sie weiter. In Googles organischer Suche fielen die Domains nach 8 Tagen und nach rund 12 Wochen auf nahezu null Impressionen, Googles KI-Antworten zitierten sie von April bis 27. Juli zusammen nur 30-mal. Die zuerst aussortierte Domain kam im selben Zeitraum auf 3.934 KI-Zitierungen, 2.718 davon aus Microsoft Copilot. Eine Ahrefs-Auswertung der 1.000 meistzitierten Domains je Plattform zeigt über viele Themen hinweg dasselbe Bild für Copilot und Google, für ChatGPT und Perplexity ein gemischtes. Bewerte deine AI Visibility (Sichtbarkeit in KI-Antworten) deshalb je Plattform und baue auf Inhalte, die Googles Spam-Filter bestehen.

Wie war das Otterly-Experiment aufgebaut?

Otterly.ai hat Anfang April 2026 zwei neu registrierte Domains mit je rund 1.000 vollständig KI-generierten Artikeln zum Thema Capybaras (Wasserschweine) gefüllt. Die Artikel stammen aus einem handelsüblichen KI-Content-Tool, ohne menschliche Bearbeitung.

Aufbau des Experiments · 2 Domains, je rund 1.000 KI-Artikel, 7 KI-Plattformen
capybaraverse.com
rund 1.000 KI-Artikel, ohne Autorenangaben
capybara-world.com
rund 1.000 KI-Artikel, je mit Autorenbox eines erfundenen Wildbiologen („15+ years of field experience“)
Beide Domains: neu registriert, in unter einem Tag veröffentlicht, keine Redaktion
Messwege
Search ConsoleGoogle-Impressionen und Klicks, 01.04. bis 25.07.2026
Server-LogsBesuche von KI-Bots wie ChatGPT-User
Brand ReportKI-Zitierungen in 7 Plattformen, USA, 01.04. bis 27.07.2026
Quelle: Otterly.ai (08/2026) · geplante Variable: erfundener Autor; ihr Effekt ist laut Otterly nicht isolierbar

Getestet werden sollte das Autorensignal: Stärkt eine Autorenbox die wahrgenommenen E-E-A-T-Signale (Erfahrung, Expertise, Autorität, Vertrauenswürdigkeit) so, dass KI-Massen-Content länger überlebt? Die Texte sollten laut Otterly eigenständige Neufassungen sein, keine Kopien.

Erkennt Google massenhaft erstellte KI-Texte?

Im Experiment ja: Google hat beide Domains aus der organischen Suche aussortiert, ohne manuelle Maßnahme und ohne Warnung. capybara-world.com stürzte am 9. April über Nacht von 1.629 auf 15 Impressionen am Tag ab, vier Tage nach dem Höchstwert von 2.426. capybaraverse.com hielt sich bis Ende Juni:

Google-Impressionen je Tag vor und nach dem Absturz · je Domain, organische Websuche
capybara-world.comnach rund 8 Tagen
2.426
Höchstwert am 5. April
15
am 9. April, keine Erholung
capybaraverse.comnach rund 12 Wochen
4.202
Spitzentag am 7. Mai
9
am 27. Juni, nach 859 am 25. und 85 am 26. Juni
0manuelle Maßnahmen: Die Search Console meldet „No issues detected“
Quelle: Otterly.ai (08/2026) · Google Search Console, 01.04. bis 25.07.2026

Otterly deutet das als algorithmische Abstrafung wegen „Scaled content abuse“, also massenhaft erzeugter Seiten ohne Mehrwert. Welches System gegriffen hat, bestätigt Google nicht. Ohne Meldung verschob sich auch der Bericht zur Indexierung: Bei capybaraverse.com führte die Search Console, zu einem nicht genannten Zeitpunkt, 478 Seiten als nicht indexiert und 538 als indexiert.

Googles KI-Antworten folgten der Suche: AI Overviews, AI Mode und Gemini zitierten capybara-world.com nie und capybaraverse.com 30-mal (AI Mode 19, AI Overviews 11). Insgesamt hat Otterly zum Thema Capybaras 482.394 Zitierungen über sieben Plattformen erfasst.

Welche KI-Suchsysteme zitieren die aussortierten Domains weiter?

Vor allem Copilot, Claude und Perplexity. Während capybara-world.com in der Google-Suche kaum noch Impressionen bekam, stiegen ihre KI-Zitierungen, über alle sieben Plattformen summiert, jeden Monat:

capybara-world.com: Google-Impressionen und KI-Zitierungen entwickeln sich gegenläufig · je auf den eigenen Höchstwert normiert
Organische Google-Suche
Impressionen je Tag, Absturz am 9. April
KI-Zitierungen, 7 Plattformen
je Monat: 100 · 845 · 1.323 · 1.666 (1.–27. Juli), am Monatsende eingezeichnet
Quelle: Otterly.ai (08/2026) · Search Console 01.04. bis 25.07.2026 · Brand Report 01.04. bis 27.07.2026, USA

Der Anstieg von 100 auf 1.666 entspricht knapp dem 17-Fachen, je Tag laut Otterly dem 18-Fachen (61,7 statt 3,3 Zitierungen), weil der Juli-Wert nur 27 Tage umfasst. Die Aufteilung zeigt, wie unterschiedlich die sieben Plattformen dieselben Inhalte bewerten:

KI-Zitierungen je Plattform · beide Domains, 01.04. bis 27.07.2026, USA
Microsoft Copilot2.718 · 543
Claude714 · 1.005
Perplexity501 · 628
praktisch keine Zitierungen
Google AI Mode0 · 19
Google AI Overviews0 · 11
Gemini0 · 0
ChatGPT0 · 0
Quelle: Otterly.ai Brand Report (08/2026) · Balkenlänge relativ zu Copilot, beide Domains zusammen 3.261 (eigene Summe)

Bing hat keine der Domains deindexiert und lieferte beiden zusammen im Juli 119.935 Impressionen, Google 751. Im Juli entfielen 14 % aller Copilot-Zitierungen zum Thema Capybaras auf capybara-world.com, mehr als auf Wikipedia oder Britannica. Laut Otterly speist Bingbot das Grounding von Copilot, also die Webquellen seiner Antworten. Perplexity beginnt laut Otterly als erste Plattform, die Testdomains wieder herauszufiltern: Die Zitierungen beider Domains sanken von 444 im Mai auf 208 im Juli, ein Minus von 53 %. Reicht der Juli-Wert wie die übrigen Zitierdaten nur bis zum 27. Juli, sind es je Tag rund 46 % weniger.

Ruft ChatGPT die Testdomains ab, ohne sie zu zitieren?

Ja. ChatGPT zitierte keine der Domains in 122.834 getrackten Antworten bis zum 5. August 2026, rief ihre Seiten in den 90 Tagen davor aber 5.332-mal ab. Die Abrufe kamen von ChatGPT-User, dem User-Agent für Live-Abrufe während einer Konversation, und übertrafen alle anderen KI-Bots zusammen. Der OAI-SearchBot, der ChatGPTs Suchindex befüllt, kam im selben Zeitraum nur 80-mal. Laut Otterly hat ChatGPTs eigene Quellenauswahl die Inhalte vollständig abgelehnt, auch die 119.935 Bing-Impressionen im Juli brachten keine Zitierung. Das passt dazu, dass ChatGPT Quellen aus einem eigenen Suchindex wählt statt aus Bing.

Was zeigt die Ahrefs-Auswertung der meistzitierten Quellen?

Ein ähnliches Gefälle zwischen Copilot und Google, über viele Themen statt einer Nische: Copilot, ChatGPT und Perplexity führen Domains mit wenig Such-Traffic unter ihren meistzitierten Quellen, Google AI Overviews im Juni keine. Ahrefs hat mit dem eigenen Tool Brand Radar die 1.000 meistzitierten Domains je Plattform von Januar bis Juni 2026 ausgewertet und deren organischen Such-Traffic geschätzt. Gezählt sind Domains mit höchstens 10.000 organischen Besuchen im Monat, die im Juni bei genau einer Plattform in den Top 1.000 standen und bei keiner anderen:

Low-Traffic-Domains, die im Juni 2026 nur bei dieser Plattform in den Top 1.000 standen · 0 bis 10.000 organische Besuche im Monat · Prozent: Anteil an allen Low-Traffic-Domains der Plattform
Microsoft Copilot62,9 %122
ChatGPT51 %80
Perplexity35,1 %33
Google AI Overviewskeine Low-Traffic-Domain in den Top 1.0000
Alle Low-Traffic-Domains in den Top 1.000 · Januar → März → Juni, rund
ChatGPT118 → 206 → 157seit März rückläufig
Copilot199 → 196 → 193gleichbleibend hoch
Perplexity31 → 65 → 93steigend
AI Overviews4 → 2 → 0ab Mai 0
Quelle: Ahrefs, Auswertung mit Brand Radar (29.06.2026) · Verlauf aus der Balkengrafik abgelesen (±3) · laut Autor eine Richtungsangabe

Die Zahlen sind keine Spam-Zählung: Wenig Such-Traffic ist nur ein Indiz für Spam. Der Autor der Auswertung, ein Ahrefs-Mitarbeiter, hat Hunderte Domains von Hand gesichtet, die in KI-Antworten stark und in der Suche schwach sind. Ein erheblicher Teil davon sei minderwertig („aren’t great“): gefälschte oder fehlende Autoren, Tausende KI-Artikel ohne erkennbares Thema, Onlineshops mit über 100.000 zufälligen Produkten. Nur 24 Low-Traffic-Domains standen im Juni bei ChatGPT, Copilot und Perplexity zugleich in den Top 1.000.

Weil der Maßstab Googles eigener Such-Traffic ist, sind niedrige Werte für AI Overviews zum Teil methodisch angelegt: Googles KI-Antworten stützen sich auf Seiten, die in der Google-Suche ranken. Aussagekräftiger ist der Vergleich zwischen ChatGPT, Copilot und Perplexity, und dort passen Otterly und Ahrefs nur bei Copilot zusammen. ChatGPT zitierte die Testdomains nie, führt bei Ahrefs aber die zweitmeisten exklusiven Low-Traffic-Domains. Perplexity zitiert die Testdomains seltener, bei Ahrefs steigt sein Wert. Beide Quellen messen allerdings Verschiedenes: Zitierungen zweier Testdomains gegen Low-Traffic-Domains unter den Top-Quellen.

Warum filtert Google Spam in AI Search besser?

Die Quellen sprechen für den Suchindex unter den KI-Antworten als Grund: Googles KI-Antworten holen ihre Quellen per Retrieval aus dem Google-Suchindex, in dem Google Spam seit über zwei Jahrzehnten bekämpft, seit 2018 auch mit dem KI-System SpamBrain. Google selbst sprach 2022 von fast zwei Jahrzehnten. Die Spam-Richtlinien gelten ausdrücklich auch für Versuche, KI-Antworten in der Google-Suche zu manipulieren. Otterly beobachtete, dass die Abstrafung aus der Suche auch in AI Overviews, AI Mode und Gemini galt. Ob Google dabei schon im Index oder erst bei der Auswahl der Antwortquellen filtert, legt keine der Quellen offen.

Quellenbasis, Spam-Abwehr und Ergebnis · Googles KI-Antworten gegen die übrigen KI-Suchsysteme
MerkmalGoogle AI Overviews, AI ModeChatGPT, Copilot, Claude, Perplexity
QuellenbasisGoogleGoogle-SuchindexÜbrige SystemeBing-Index, eigene Crawler und Indizes, Drittanbieter
Spam-AbwehrGooglelaut Google 2022 seit fast zwei Jahrzehnten, SpamBrain seit 2018Übrige Systemenicht offengelegt; laut Otterly bei Copilot keine erkennbare Qualitätsschicht über dem Bing-Index, bei ChatGPT eine eigene Quellenauswahl
Zitierungen der TestdomainsGoogle0 (capybara-world.com) und 30 (capybaraverse.com)Übrige SystemeCopilot 3.261, Claude 1.719, Perplexity 1.129, ChatGPT 0
Quellen: Google Search Central (04/2022, 08/2026) · Otterly.ai (08/2026) · Summen je Plattform: eigene Rechnung

Straft Google KI-Texte ab?

Laut Google nicht den Einsatz von KI, sondern Massen-Content ohne Mehrwert. Im Experiment traf es rund 1.000 unredigierte Artikel je Domain, in unter einem Tag veröffentlicht, auf einer der beiden Domains zusätzlich mit erfundenem Autor. Das Experiment selbst trennt KI-Einsatz und Machart nicht, eine Vergleichsgruppe mit redigierten Texten fehlt. Für die Machart als Auslöser sprechen Googles Richtlinien: Angemessener KI-Einsatz verstößt laut Google seit Februar 2023 nicht dagegen („Appropriate use of AI or automation is not against our guidelines“). Seit März 2024 richtet sich die Richtlinie „Scaled content abuse“ gegen viele Seiten, die vor allem zur Ranking-Manipulation entstehen, „no matter how it’s created“, also unabhängig davon, wie sie erstellt wurden.

Dazu passt eine Studie von Ahrefs mit 600.000 Seiten, die unter den Top 20 für 100.000 Keywords rankten (07/2025): Laut dem eigenen KI-Detektor von Ahrefs enthielten 86,5 % KI-Anteile, zwischen KI-Anteil und Ranking-Position fand Ahrefs praktisch keinen Zusammenhang (Korrelation 0,011). Weil nicht rankende Seiten fehlen, schließt die Studie eine Abstrafung nicht aus. Sie zeigt nur, dass KI-Anteile unter rankenden Seiten keinen Rangnachteil bringen. Otterly selbst empfiehlt, KI für Inhalte einzusetzen, die Sprachmodelle noch nicht kennen: eigene Daten, Erfahrung aus erster Hand, exklusive Einsichten.

Wie belastbar sind die Zahlen?

Für Copilot und Google zeigen beide Quellen in dieselbe Richtung, für ChatGPT und Perplexity nicht. Die einzelnen Werte sind Momentaufnahmen:

Was die Daten tragen und was nicht · je Quelle
Quelle✓ trägt✕ trägt nicht
Otterly-Experiment✓ trägtUmgang von Google und 7 KI-Plattformen mit Massen-Content, auf 2 Domains✕ trägt nichtden Effekt erfundener Autoren, die Trennung von KI-Einsatz und Machart; YMYL-Themen (Your Money or Your Life, etwa Finanzen), den deutschen Markt
Ahrefs-Auswertung✓ trägtGefälle zwischen Copilot und Google, Richtung über 6 Monate✕ trägt nichteine Spam-Zählung, einen unabhängigen Test für AI Overviews; Aussagen über Quellen jenseits der Top 1.000 oder über einzelne Branchen
Google-Richtlinien✓ trägtlange Spam-Historie, Regel gegen Massen-Content✕ trägt nichtwie AI Overviews technisch filtern
Quellen: Otterly.ai (08/2026) · Ahrefs (06/2026) · Google Search Central

Ob die Befunde für Finanz- und Versicherungsthemen im deutschen Markt gelten, misst keine der Quellen.

Was heißt das für deine AI-Search-Strategie?

Bewerte AI Visibility je Plattform und baue auf Inhalte, die auch Googles Spam-Systeme bestehen:

✓AI Visibility je Plattform messenDieselben Inhalte kamen in Copilot auf 3.261 Zitierungen, in ChatGPT auf 0. Ein Durchschnitt verdeckt das.
✓Zitierumfeld mitbewertenPrüfe, neben welchen Quellen deine Brand zitiert wird. Wo viele Spam-Domains mitlaufen, sagt eine Zitierung wenig über Qualität aus.
✓KI mit Redaktion einsetzenAussortiert wurde Masse ohne Redaktion. Otterly rät von unredigierter KI-Masse ab und empfiehlt eigene Daten, Erfahrung aus erster Hand und exklusive Einsichten.
✓Autoren nachprüfbar angebenEchte, prüfbare Autoren bleiben die Basis für E-E-A-T. Eine erfundene Expertenbox bewahrte capybara-world.com nicht vor dem Absturz nach 8 Tagen.
✓Abrufe nicht als Erfolg werten5.332 Abrufe durch ChatGPT-User in 90 Tagen führten zu 0 Zitierungen.
✓Search Console eng beobachtenDie Abstrafung kam ohne Meldung. Sichtbar war sie nur am Einbruch der Impressionen und an nicht indexierten Seiten. Otterly rät, die Zahl indexierter Seiten wöchentlich zu prüfen.

Ist Googles Spam-Filter ein dauerhafter Vorsprung?

Aus meiner Sicht ist er ein Vorsprung auf Zeit, aber kein kurzer. Googles größte Stärke in AI Search ist die Spam-Abwehr unter dem Modell: AI Overviews und AI Mode sitzen auf einem Index mit über zwei Jahrzehnten Spam-Bekämpfung. Bei Copilot, Claude und Perplexity ist diese Filterschicht erst im Aufbau, ChatGPT baut mit eigenem Index und eigener Quellenauswahl eine eigene auf.

Dieser Vorsprung beruht vor allem auf Daten. Spam-Erkennung wird aus Beispielen gelernt, und Google sieht seit über zwei Jahrzehnten, wie Spam aussieht. Die Verfahren lassen sich übernehmen. Die übrigen Anbieter brauchen deshalb keine zwei Jahrzehnte, um aufzuholen, aber mehr als ein Quartal. ChatGPT zeigt Fortschritt: In der Ahrefs-Auswertung sinkt die Zahl seiner Low-Traffic-Domains seit März, von rund 206 auf 157. Perplexity zitiert die Testdomains seltener (minus 53 % von Mai bis Juli), in der Ahrefs-Auswertung steigt die Zahl seiner Low-Traffic-Domains aber von rund 31 auf 93. Copilot sitzt auf dem Bing-Index, und Bing hat die Testdomains nicht aussortiert: Copilot zitierte capybara-world.com 2.718-mal. Ein großer Index allein reicht also nicht. Es fehlt eine Qualitätsbewertung zwischen Index und Antwort, und die lässt sich schwerer einkaufen als Crawling-Kapazität.

Für uns Search-Marketer ist Sichtbarkeit mit Spam-Content in KI-Suchen ein Fenster mit Ablaufdatum, kein Fundament. Im Experiment brachen die Domains in Google ohne Warnung ein, und Perplexity filtert bereits nach. Weil sieben Plattformen dieselben Inhalte so unterschiedlich bewertet haben, messen wir bei KKP die AI Visibility von Banken und Versicherern je Plattform, als Teil unserer AI-Search-Beratung.

Aus meiner Sicht liegt Googles Stärke in der Filterschicht unter den KI-Antworten. Copilot fehlt sie im Experiment sichtbar, ChatGPT baut eine eigene auf.

Häufige Fragen zu Spam in AI Search

Was ist Scaled Content Abuse?

„Scaled content abuse“ ist eine Spam-Richtlinie, die Google seit März 2024 führt. Sie richtet sich gegen viele Seiten, die vor allem zur Manipulation von Rankings entstehen, unabhängig davon, wie sie erstellt wurden, etwa mit generativer KI ohne Mehrwert für Nutzer. Im Otterly-Experiment (08/2026) fielen zwei Domains mit je rund 1.000 unredigierten KI-Artikeln nach 8 Tagen und nach rund 12 Wochen auf nahezu null Google-Impressionen. Otterly deutet das als Abstrafung nach dieser Richtlinie, eine manuelle Maßnahme gab es nicht.

Zitiert Microsoft Copilot Seiten, die Google aussortiert hat?

Im Otterly-Experiment ja. Copilot zitierte die Testdomain capybara-world.com, die Google nach 8 Tagen aussortiert hatte, vom 1. April bis 27. Juli 2026 insgesamt 2.718-mal. Das waren 69 % ihrer 3.934 KI-Zitierungen. Bing hatte beide Testdomains im Index behalten und lieferte ihnen zusammen im Juli 119.935 Impressionen, Google 751.

Warum zitieren Googles KI-Antworten weniger Spam als Microsoft Copilot?

Die Quellen legen nahe, dass es am Suchindex unter den KI-Antworten liegt: Googles KI-Antworten greifen auf den Google-Suchindex zurück, in dem Google Spam seit über zwei Jahrzehnten bekämpft. Im Otterly-Experiment (08/2026) zitierten AI Overviews, AI Mode und Gemini zwei Domains mit unredigiertem KI-Massen-Content zusammen 30-mal, Copilot 3.261-mal. Eine Ahrefs-Auswertung der 1.000 meistzitierten Domains je Plattform (Juni 2026) zeigt ein ähnliches Gefälle, zählt aber Domains mit wenig Google-Traffic, nicht Spam: Wenig Traffic ist nur ein Indiz, Spam-Merkmale fand Ahrefs per Stichprobe.

Warum crawlt ChatGPT eine Website, zitiert sie aber nicht?

Ein Abruf ist noch keine Zitierung, und ChatGPT-User ist kein Index-Crawler, sondern ruft Seiten live während einer Konversation ab. Im Otterly-Experiment rief ChatGPT-User die Testdomains in den 90 Tagen bis 5. August 2026 insgesamt 5.332-mal ab, zitiert wurden sie bei 122.834 getrackten ChatGPT-Antworten nie. Zitiert wird laut Otterly über ChatGPTs eigenen Suchindex und eine eigene Quellenauswahl. Der Crawler für diesen Index, OAI-SearchBot, kam im selben Zeitraum nur 80-mal.

Holt ChatGPT bei der Spam-Erkennung gegenüber Google auf?

In der Ahrefs-Auswertung gibt es Anzeichen dafür: Die Zahl der Domains mit höchstens 10.000 organischen Besuchen in ChatGPTs Top 1.000 sank von rund 206 im März auf rund 157 im Juni 2026. Das ist eine Richtungsangabe, weil die abgefragten Prompts monatlich wechseln. Im Otterly-Test (08/2026) hat ChatGPT die Testdomains sogar vollständig herausgefiltert und in 122.834 getrackten Antworten nie zitiert, Googles KI-Antworten zitierten eine davon 30-mal.