Bei Spam in AI Search gehen die Plattformen weit auseinander: Im Experiment von Otterly.ai sortierte Google zwei Domains mit je rund 1.000 unredigierten KI-Artikeln aus, Copilot, Claude und Perplexity zitierten sie weiter. In Googles organischer Suche fielen die Domains nach 8 Tagen und nach rund 12 Wochen auf nahezu null Impressionen, Googles KI-Antworten zitierten sie von April bis 27. Juli zusammen nur 30-mal. Die zuerst aussortierte Domain kam im selben Zeitraum auf 3.934 KI-Zitierungen, 2.718 davon aus Microsoft Copilot. Eine Ahrefs-Auswertung der 1.000 meistzitierten Domains je Plattform zeigt über viele Themen hinweg dasselbe Bild für Copilot und Google, für ChatGPT und Perplexity ein gemischtes. Bewerte deine AI Visibility (Sichtbarkeit in KI-Antworten) deshalb je Plattform und baue auf Inhalte, die Googles Spam-Filter bestehen.
Wie war das Otterly-Experiment aufgebaut?
Otterly.ai hat Anfang April 2026 zwei neu registrierte Domains mit je rund 1.000 vollständig KI-generierten Artikeln zum Thema Capybaras (Wasserschweine) gefüllt. Die Artikel stammen aus einem handelsüblichen KI-Content-Tool, ohne menschliche Bearbeitung.
Getestet werden sollte das Autorensignal: Stärkt eine Autorenbox die wahrgenommenen E-E-A-T-Signale (Erfahrung, Expertise, Autorität, Vertrauenswürdigkeit) so, dass KI-Massen-Content länger überlebt? Die Texte sollten laut Otterly eigenständige Neufassungen sein, keine Kopien.
Erkennt Google massenhaft erstellte KI-Texte?
Im Experiment ja: Google hat beide Domains aus der organischen Suche aussortiert, ohne manuelle Maßnahme und ohne Warnung. capybara-world.com stürzte am 9. April über Nacht von 1.629 auf 15 Impressionen am Tag ab, vier Tage nach dem Höchstwert von 2.426. capybaraverse.com hielt sich bis Ende Juni:
Otterly deutet das als algorithmische Abstrafung wegen „Scaled content abuse“, also massenhaft erzeugter Seiten ohne Mehrwert. Welches System gegriffen hat, bestätigt Google nicht. Ohne Meldung verschob sich auch der Bericht zur Indexierung: Bei capybaraverse.com führte die Search Console, zu einem nicht genannten Zeitpunkt, 478 Seiten als nicht indexiert und 538 als indexiert.
Googles KI-Antworten folgten der Suche: AI Overviews, AI Mode und Gemini zitierten capybara-world.com nie und capybaraverse.com 30-mal (AI Mode 19, AI Overviews 11). Insgesamt hat Otterly zum Thema Capybaras 482.394 Zitierungen über sieben Plattformen erfasst.
Welche KI-Suchsysteme zitieren die aussortierten Domains weiter?
Vor allem Copilot, Claude und Perplexity. Während capybara-world.com in der Google-Suche kaum noch Impressionen bekam, stiegen ihre KI-Zitierungen, über alle sieben Plattformen summiert, jeden Monat:
Der Anstieg von 100 auf 1.666 entspricht knapp dem 17-Fachen, je Tag laut Otterly dem 18-Fachen (61,7 statt 3,3 Zitierungen), weil der Juli-Wert nur 27 Tage umfasst. Die Aufteilung zeigt, wie unterschiedlich die sieben Plattformen dieselben Inhalte bewerten:
Bing hat keine der Domains deindexiert und lieferte beiden zusammen im Juli 119.935 Impressionen, Google 751. Im Juli entfielen 14 % aller Copilot-Zitierungen zum Thema Capybaras auf capybara-world.com, mehr als auf Wikipedia oder Britannica. Laut Otterly speist Bingbot das Grounding von Copilot, also die Webquellen seiner Antworten. Perplexity beginnt laut Otterly als erste Plattform, die Testdomains wieder herauszufiltern: Die Zitierungen beider Domains sanken von 444 im Mai auf 208 im Juli, ein Minus von 53 %. Reicht der Juli-Wert wie die übrigen Zitierdaten nur bis zum 27. Juli, sind es je Tag rund 46 % weniger.
Ruft ChatGPT die Testdomains ab, ohne sie zu zitieren?
Ja. ChatGPT zitierte keine der Domains in 122.834 getrackten Antworten bis zum 5. August 2026, rief ihre Seiten in den 90 Tagen davor aber 5.332-mal ab. Die Abrufe kamen von ChatGPT-User, dem User-Agent für Live-Abrufe während einer Konversation, und übertrafen alle anderen KI-Bots zusammen. Der OAI-SearchBot, der ChatGPTs Suchindex befüllt, kam im selben Zeitraum nur 80-mal. Laut Otterly hat ChatGPTs eigene Quellenauswahl die Inhalte vollständig abgelehnt, auch die 119.935 Bing-Impressionen im Juli brachten keine Zitierung. Das passt dazu, dass ChatGPT Quellen aus einem eigenen Suchindex wählt statt aus Bing.
Was zeigt die Ahrefs-Auswertung der meistzitierten Quellen?
Ein ähnliches Gefälle zwischen Copilot und Google, über viele Themen statt einer Nische: Copilot, ChatGPT und Perplexity führen Domains mit wenig Such-Traffic unter ihren meistzitierten Quellen, Google AI Overviews im Juni keine. Ahrefs hat mit dem eigenen Tool Brand Radar die 1.000 meistzitierten Domains je Plattform von Januar bis Juni 2026 ausgewertet und deren organischen Such-Traffic geschätzt. Gezählt sind Domains mit höchstens 10.000 organischen Besuchen im Monat, die im Juni bei genau einer Plattform in den Top 1.000 standen und bei keiner anderen:
Die Zahlen sind keine Spam-Zählung: Wenig Such-Traffic ist nur ein Indiz für Spam. Der Autor der Auswertung, ein Ahrefs-Mitarbeiter, hat Hunderte Domains von Hand gesichtet, die in KI-Antworten stark und in der Suche schwach sind. Ein erheblicher Teil davon sei minderwertig („aren’t great“): gefälschte oder fehlende Autoren, Tausende KI-Artikel ohne erkennbares Thema, Onlineshops mit über 100.000 zufälligen Produkten. Nur 24 Low-Traffic-Domains standen im Juni bei ChatGPT, Copilot und Perplexity zugleich in den Top 1.000.
Weil der Maßstab Googles eigener Such-Traffic ist, sind niedrige Werte für AI Overviews zum Teil methodisch angelegt: Googles KI-Antworten stützen sich auf Seiten, die in der Google-Suche ranken. Aussagekräftiger ist der Vergleich zwischen ChatGPT, Copilot und Perplexity, und dort passen Otterly und Ahrefs nur bei Copilot zusammen. ChatGPT zitierte die Testdomains nie, führt bei Ahrefs aber die zweitmeisten exklusiven Low-Traffic-Domains. Perplexity zitiert die Testdomains seltener, bei Ahrefs steigt sein Wert. Beide Quellen messen allerdings Verschiedenes: Zitierungen zweier Testdomains gegen Low-Traffic-Domains unter den Top-Quellen.
Warum filtert Google Spam in AI Search besser?
Die Quellen sprechen für den Suchindex unter den KI-Antworten als Grund: Googles KI-Antworten holen ihre Quellen per Retrieval aus dem Google-Suchindex, in dem Google Spam seit über zwei Jahrzehnten bekämpft, seit 2018 auch mit dem KI-System SpamBrain. Google selbst sprach 2022 von fast zwei Jahrzehnten. Die Spam-Richtlinien gelten ausdrücklich auch für Versuche, KI-Antworten in der Google-Suche zu manipulieren. Otterly beobachtete, dass die Abstrafung aus der Suche auch in AI Overviews, AI Mode und Gemini galt. Ob Google dabei schon im Index oder erst bei der Auswahl der Antwortquellen filtert, legt keine der Quellen offen.
Straft Google KI-Texte ab?
Laut Google nicht den Einsatz von KI, sondern Massen-Content ohne Mehrwert. Im Experiment traf es rund 1.000 unredigierte Artikel je Domain, in unter einem Tag veröffentlicht, auf einer der beiden Domains zusätzlich mit erfundenem Autor. Das Experiment selbst trennt KI-Einsatz und Machart nicht, eine Vergleichsgruppe mit redigierten Texten fehlt. Für die Machart als Auslöser sprechen Googles Richtlinien: Angemessener KI-Einsatz verstößt laut Google seit Februar 2023 nicht dagegen („Appropriate use of AI or automation is not against our guidelines“). Seit März 2024 richtet sich die Richtlinie „Scaled content abuse“ gegen viele Seiten, die vor allem zur Ranking-Manipulation entstehen, „no matter how it’s created“, also unabhängig davon, wie sie erstellt wurden.
Dazu passt eine Studie von Ahrefs mit 600.000 Seiten, die unter den Top 20 für 100.000 Keywords rankten (07/2025): Laut dem eigenen KI-Detektor von Ahrefs enthielten 86,5 % KI-Anteile, zwischen KI-Anteil und Ranking-Position fand Ahrefs praktisch keinen Zusammenhang (Korrelation 0,011). Weil nicht rankende Seiten fehlen, schließt die Studie eine Abstrafung nicht aus. Sie zeigt nur, dass KI-Anteile unter rankenden Seiten keinen Rangnachteil bringen. Otterly selbst empfiehlt, KI für Inhalte einzusetzen, die Sprachmodelle noch nicht kennen: eigene Daten, Erfahrung aus erster Hand, exklusive Einsichten.
Wie belastbar sind die Zahlen?
Für Copilot und Google zeigen beide Quellen in dieselbe Richtung, für ChatGPT und Perplexity nicht. Die einzelnen Werte sind Momentaufnahmen:
- Kleine Stichprobe. Zwei Domains, eine Nische, USA, Englisch, kein YMYL-Thema wie Finanzen oder Versicherung. Otterly nennt das Setup selbst „not a clean A/B test“, weil beide Domains um dieselben Suchanfragen konkurrierten (Kannibalisierung).
- Eigene Werkzeuge. Otterly misst mit dem eigenen Tool und legt das Prompt-Set nicht offen, die Top-1.000-Auswertung stammt von einem Ahrefs-Mitarbeiter. Beide Anbieter verkaufen AI-Visibility-Tracking, ein Peer-Review gibt es nicht.
- Wechselnde Basis. Brand Radar tauscht seine Prompts laufend aus und stellt AI Overviews rund 282 Mio. Suchanfragen im Monat, den Chatbots je 13 bis 15 Mio. (Stand der Methodik-Seite, erstes Halbjahr 2026). Der Autor der Top-1.000-Auswertung nennt sie „directional rather than definitive“, also eine Richtungsangabe.
- Begriff „Spam-Websites“. Die Bezeichnung „spammy websites“ für die Werte 122, 80, 33 und 0 stammt aus einem späteren X-Post des Ahrefs-Marketingchefs, die Originalgrafik zählt Low-Traffic-Domains.
Ob die Befunde für Finanz- und Versicherungsthemen im deutschen Markt gelten, misst keine der Quellen.
Was heißt das für deine AI-Search-Strategie?
Bewerte AI Visibility je Plattform und baue auf Inhalte, die auch Googles Spam-Systeme bestehen:
Ist Googles Spam-Filter ein dauerhafter Vorsprung?
Aus meiner Sicht ist er ein Vorsprung auf Zeit, aber kein kurzer. Googles größte Stärke in AI Search ist die Spam-Abwehr unter dem Modell: AI Overviews und AI Mode sitzen auf einem Index mit über zwei Jahrzehnten Spam-Bekämpfung. Bei Copilot, Claude und Perplexity ist diese Filterschicht erst im Aufbau, ChatGPT baut mit eigenem Index und eigener Quellenauswahl eine eigene auf.
Dieser Vorsprung beruht vor allem auf Daten. Spam-Erkennung wird aus Beispielen gelernt, und Google sieht seit über zwei Jahrzehnten, wie Spam aussieht. Die Verfahren lassen sich übernehmen. Die übrigen Anbieter brauchen deshalb keine zwei Jahrzehnte, um aufzuholen, aber mehr als ein Quartal. ChatGPT zeigt Fortschritt: In der Ahrefs-Auswertung sinkt die Zahl seiner Low-Traffic-Domains seit März, von rund 206 auf 157. Perplexity zitiert die Testdomains seltener (minus 53 % von Mai bis Juli), in der Ahrefs-Auswertung steigt die Zahl seiner Low-Traffic-Domains aber von rund 31 auf 93. Copilot sitzt auf dem Bing-Index, und Bing hat die Testdomains nicht aussortiert: Copilot zitierte capybara-world.com 2.718-mal. Ein großer Index allein reicht also nicht. Es fehlt eine Qualitätsbewertung zwischen Index und Antwort, und die lässt sich schwerer einkaufen als Crawling-Kapazität.
Für uns Search-Marketer ist Sichtbarkeit mit Spam-Content in KI-Suchen ein Fenster mit Ablaufdatum, kein Fundament. Im Experiment brachen die Domains in Google ohne Warnung ein, und Perplexity filtert bereits nach. Weil sieben Plattformen dieselben Inhalte so unterschiedlich bewertet haben, messen wir bei KKP die AI Visibility von Banken und Versicherern je Plattform, als Teil unserer AI-Search-Beratung.
Häufige Fragen zu Spam in AI Search
Was ist Scaled Content Abuse?
„Scaled content abuse“ ist eine Spam-Richtlinie, die Google seit März 2024 führt. Sie richtet sich gegen viele Seiten, die vor allem zur Manipulation von Rankings entstehen, unabhängig davon, wie sie erstellt wurden, etwa mit generativer KI ohne Mehrwert für Nutzer. Im Otterly-Experiment (08/2026) fielen zwei Domains mit je rund 1.000 unredigierten KI-Artikeln nach 8 Tagen und nach rund 12 Wochen auf nahezu null Google-Impressionen. Otterly deutet das als Abstrafung nach dieser Richtlinie, eine manuelle Maßnahme gab es nicht.
Zitiert Microsoft Copilot Seiten, die Google aussortiert hat?
Im Otterly-Experiment ja. Copilot zitierte die Testdomain capybara-world.com, die Google nach 8 Tagen aussortiert hatte, vom 1. April bis 27. Juli 2026 insgesamt 2.718-mal. Das waren 69 % ihrer 3.934 KI-Zitierungen. Bing hatte beide Testdomains im Index behalten und lieferte ihnen zusammen im Juli 119.935 Impressionen, Google 751.
Warum zitieren Googles KI-Antworten weniger Spam als Microsoft Copilot?
Die Quellen legen nahe, dass es am Suchindex unter den KI-Antworten liegt: Googles KI-Antworten greifen auf den Google-Suchindex zurück, in dem Google Spam seit über zwei Jahrzehnten bekämpft. Im Otterly-Experiment (08/2026) zitierten AI Overviews, AI Mode und Gemini zwei Domains mit unredigiertem KI-Massen-Content zusammen 30-mal, Copilot 3.261-mal. Eine Ahrefs-Auswertung der 1.000 meistzitierten Domains je Plattform (Juni 2026) zeigt ein ähnliches Gefälle, zählt aber Domains mit wenig Google-Traffic, nicht Spam: Wenig Traffic ist nur ein Indiz, Spam-Merkmale fand Ahrefs per Stichprobe.
Warum crawlt ChatGPT eine Website, zitiert sie aber nicht?
Ein Abruf ist noch keine Zitierung, und ChatGPT-User ist kein Index-Crawler, sondern ruft Seiten live während einer Konversation ab. Im Otterly-Experiment rief ChatGPT-User die Testdomains in den 90 Tagen bis 5. August 2026 insgesamt 5.332-mal ab, zitiert wurden sie bei 122.834 getrackten ChatGPT-Antworten nie. Zitiert wird laut Otterly über ChatGPTs eigenen Suchindex und eine eigene Quellenauswahl. Der Crawler für diesen Index, OAI-SearchBot, kam im selben Zeitraum nur 80-mal.
Holt ChatGPT bei der Spam-Erkennung gegenüber Google auf?
In der Ahrefs-Auswertung gibt es Anzeichen dafür: Die Zahl der Domains mit höchstens 10.000 organischen Besuchen in ChatGPTs Top 1.000 sank von rund 206 im März auf rund 157 im Juni 2026. Das ist eine Richtungsangabe, weil die abgefragten Prompts monatlich wechseln. Im Otterly-Test (08/2026) hat ChatGPT die Testdomains sogar vollständig herausgefiltert und in 122.834 getrackten Antworten nie zitiert, Googles KI-Antworten zitierten eine davon 30-mal.



