EEAT Mechanics

Anchor-Spam: Wie Google manipulative Link-Muster erkennt

Von 'miserable failure' Google-Bombs zum Patent, das offenlegt, wie Kontext-Analyse Anchor-Text-Manipulation erkennt

By Thomas Wawra· Published · Version 1.0· Systems referenced: Anchor-Spam (Penguin legacy)

01Was ist Anchor-Spam?

Anchor-Spam ist Googles System zur Erkennung manipulativer Muster im Ankertext – dem anklickbaren Text von Hyperlinks. Wenn eine Seite ausschließlich mit exakten Keyword-Texten verlinkt wird ('Berlin Wetter', 'kostenlose Wettervorhersage'), wirkt das unnatürlich und wie gezielte SEO-Manipulation. Das System bestraft diese Überoptimierung.

Der Google API Leak enthüllte zwei Felder, die diese Erkennung implementieren: phraseAnchorSpamPenalty (ein Penalty-Score für überoptimierte Ankertexte) und IsAnchorBayesSpam (ein Bayes-Klassifikator, der ein Ja/Nein-Urteil darüber abgibt, ob Anchor-Spam vorliegt). Zusammen bilden diese beiden Felder ein zweischichtiges Erkennungssystem: Der Klassifikator identifiziert verdächtige Muster, und der Penalty-Score bestimmt, wie stark eine Abstufung erfolgt.

Anchor-Spam ist der direkte Nachfolger von Googles historischem Penguin-Update, das 2012 eingeführt wurde und speziell auf Linkschemata und Ankertext-Manipulation abzielte. Die Logik lebt im heutigen System weiter, hat sich jedoch von einem periodischen Update zu einem kontinuierlichen Echtzeitsignal entwickelt, das in Googles zentrale Ranking-Architektur integriert ist.

Belege je Aussage (3)
B
Anchor-Spam erkennt manipulative Anchor-Text-Muster über phraseAnchorSpamPenalty und IsAnchorBayesSpam.[1]
Quelle: Google API Leak — Feldnamen · Anchor-Spam (Penguin legacy) · phraseAnchorSpamPenalty
O
Anchor-Spam ist der Nachfolger des Penguin-Updates (2012) und ist nun ein kontinuierliches Echtzeit-Signal.[2]
B
Die zweischichtige Erkennung: IsAnchorBayesSpam identifiziert, phraseAnchorSpamPenalty stuft herab.[3]

02Die Google-Bombing-Ära

Das Patent US8577893B1 ('Ranking based on reference contexts') beginnt mit einem berühmten Beispiel: der 'miserable failure' Google-Bombe. In den frühen 2000er Jahren verlinkten zahlreiche Websites die Biografie von Präsident George W. Bush mit dem Ankertext 'miserable failure'. Das Ergebnis: Wenn Nutzer nach 'miserable failure' suchten, war das oberste Ergebnis die Biografieseite des Weißen Hauses – obwohl diese Seite diese Wörter nie verwendete.

Google-Bombing funktionierte, weil frühe Versionen des Google-Algorithmus Ankertext als starkes Relevanzsignal behandelten. Wenn viele Seiten eine bestimmte Seite mit demselben Ankertext verlinkten, nahm Google an, dass dieser Text den Inhalt der Seite beschrieb. Die 'miserable failure'-Bombe zeigte, dass diese Annahme in großem Maßstab ausgenutzt werden konnte.

Das Patent identifiziert auch andere Manipulationstechniken: Link-Farmen (Netzwerke stark untereinander verlinkter Dokumente), bezahlte Links (Spam-Betreiber, die Inhaber hoch gerankter Dokumente für Links bezahlen) und Standard-Frames (Boilerplate-Links wie 'Products', 'Jobs', 'Investor', die auf jeder Seite einer Unternehmenswebsite erscheinen und das Ranking der verlinkten Seiten künstlich aufwerten).

Belege je Aussage (3)
P
Google-Bombing funktionierte, weil Ankertext als starkes Relevanzsignal behandelt wurde.[5]
P
Das Patent identifiziert Link-Farmen, bezahlte Links und Standard-Frames als zusätzliche Manipulationstechniken.[6]

03Das Patent: Referenz-Kontext-Analyse

US8577893B1, eingereicht im Jahr 2004 von Anna Patterson und Paul Haahr, beschreibt eine Methode zur Erkennung von Anchor-Text-Manipulation durch die Analyse des Kontexts um Links herum. Der Ansatz ist elegant: Anstatt den Anchor-Text selbst zu betrachten (den Spammer kontrollieren), werden die Wörter rund um den Link analysiert (die Spammer typischerweise nicht kontrollieren).

Die Methode funktioniert in fünf Schritten. Erstens wird für jeden Link, der auf ein Dokument verweist, ein Textfenster links des Links und ein Textfenster rechts davon analysiert (typischerweise jeweils 5 Wörter). Zweitens wird das seltenste Wort in jedem Fenster mithilfe der inversen Dokumenthäufigkeit (IDF) gewichtet identifiziert – häufige Wörter wie 'the' und 'and' werden ignoriert, während seltene Wörter wie 'Saturn' oder 'elegant' ausgewählt werden. Drittens wird ein Kontextbezeichner erstellt, indem die beiden seltenen Wörter zusammen gehasht werden. Viertens wird eine Liste aller Kontextbezeichner und ihrer Häufigkeiten für Links erstellt, die auf ein Dokument verweisen. Fünftens wird die Verteilung der Kontexthäufigkeiten analysiert, um verdächtige Muster zu erkennen.

Das Patent liefert ein konkretes Beispiel: Ein Dokument hat Links mit vier zugehörigen Kontexten. Kontext 1 hat eine Häufigkeit von 10.000; Kontext 2 hat 10; Kontext 3 hat 4; Kontext 4 hat 1. Das System identifiziert Kontext 1 als 'verdächtig (möglicherweise maschinell generiert)' und wertet ihn ab. Das Dokument wird dann so eingestuft, als hätte es nur drei Kontexte (2, 3, 4) – eine weitaus natürlichere Verteilung.

Das Patent beschreibt auch eine Zeitreihenanalyse: Wenn ein Dokument in einem Zeitraum zwei Kontexte mit je 20 Vorkommen hatte und dann plötzlich im nächsten Zeitraum drei Kontexte mit Häufigkeiten von 20, 20 und 18.000 aufweist, markiert das System dies basierend auf der Verteilungshistorie als verdächtig. Dies erkennt Link-Building-Kampagnen, die in kurzer Zeit viele Links mit identischem Anchor-Text erstellen.

Belege je Aussage (6)
P
Das Patent analysiert Textfenster links und rechts von Links, nicht den Ankertext selbst.[7]
P
Seltene Wörter werden mittels IDF-Gewichtung identifiziert — häufige Wörter werden ignoriert.[8]
P
Kontext-Identifier werden durch Hashing der zwei seltensten Wörter (links + rechts des Links) erstellt.[9]
P
Ein Kontext mit 10.000 Vorkommen gegenüber anderen mit 10/4/1 wird als 'möglicherweise maschinell generiert' markiert und abgewertet.[10]
P
Zeitliche Analyse erkennt plötzliche Spitzen: 40 Gesamtkontexte → 18.040 im nächsten Zeitraum = verdächtig.[11]
P
Erfinder Anna Patterson und Paul Haahr — Haahr erscheint in der DOJ-E-Mail-Ketten-Anlage.[12]

04Anchor-Spam in der Ranking-Architektur

Anchor-Spam operiert auf Dokumentebene (Reach: Doc) und hat keine vor- oder nachgelagerten Abhängigkeiten (fedBy und feedsInto sind beide leer). Dies macht es zu einem terminalen Signal — es erzeugt eine Penalty, die direkt auf den Ranking-Score des Dokuments angewendet wird, ohne in andere Systeme einzuspeisen.

Die architektonische Isolation von Anchor-Spam ist charakteristisch für Spam-Erkennungssysteme: Sie sind darauf ausgelegt, eigenständig zu sein und ihre Signale nicht durch die Ranking-Architektur weiterzuleiten. Eine Spam-Penalty sollte nur das bestrafte Dokument beeinflussen und keine anderen Qualitätssignale kontaminieren. Dies ist dasselbe Muster, das bei SpamBrain (System 18) zu beobachten ist, das ebenfalls als terminales Signal operiert.

Das E-E-A-T-Dimensions-Mapping bestätigt dies: Anchor-Spam ist in erster Linie ein Trust-Signal (T: primary), mit einem indirekten Effekt auf Authority (A: indirect). Anchor-Manipulation ist grundlegend eine Trust-Verletzung — sie täuscht sowohl Google als auch Nutzer über die Relevanz einer Seite. Der indirekte Authority-Effekt ergibt sich daraus, dass Anchor-Text-Muster beeinflussen, wie autoritativ eine Seite für bestimmte Suchanfragen erscheint.

Belege je Aussage (3)
B
Anchor-Spam ist ein terminales Signal – keine vor- oder nachgelagerten Abhängigkeiten.[13]
Quelle: Google API Leak — fedBy und feedsInto sind leer · Anchor-Spam (Penguin legacy)
B
Anchor-Spam ist primär ein Trust-Signal (T: primär), mit indirektem Authority-Effekt.[14]
Quelle: Google API Leak — dims: {T: primär, A: indirekt} · Anchor-Spam (Penguin legacy)
C
Spam-Erkennungssysteme sind architektonisch isoliert, um Signalkontamination zu verhindern.[15]

05Implikationen für SEO-Praktiker

Der kontextanalytische Ansatz des Patents hat eine klare Implikation: Spammer kontrollieren den Ankertext, aber sie kontrollieren den umgebenden Text nicht. Googles Erkennungssystem analysiert, was den Link umgibt – den natürlichsprachlichen Kontext, in dem der Link erscheint. Das bedeutet, dass selbst wenn der Ankertext perfekt variiert ist, unnatürliche Muster im umgebenden Text die Erkennung auslösen können.

Für legitimen Linkaufbau ist die Empfehlung eindeutig: Natürliche, beschreibende Linktexte sind besser als keyword-optimierte. Wenn externe Partner um Links gebeten werden, sollte man keine vorgefertigten Ankertexte vorschreiben. Die verlinkende Seite sollte den eigenen Inhalt in eigenen Worten beschreiben – genau diese natürliche Variation erwartet das Kontextanalysesystem.

Für die interne Verlinkung gilt dasselbe Prinzip. Variierte interne Linktexte ('Hamburger Regenradar', 'Nordsee-Sturmwarnung') anstatt immer 'Wettervorhersage' zu verwenden, reduziert das Risiko, die phraseAnchorSpamPenalty auszulösen. Interne Links liegen in der eigenen Kontrolle, und unnatürliche Muster in internen Ankertexten sind für Google sogar noch leichter zu erkennen als externe Muster.

Die Fähigkeit zur Zeitraumanalyse bedeutet, dass die Geschwindigkeit des Linkaufbaus eine Rolle spielt. Ein plötzlicher Anstieg von Links mit ähnlichem Ankertext – selbst wenn der Ankertext selbst variiert ist – kann basierend auf der Verteilungshistorie eine Erkennung auslösen. Schrittweiser, natürlicher Linkerwerb ist sicherer als Kampagnen, die viele Links in kurzer Zeit erzeugen.

Belege je Aussage (4)
P
Spammer kontrollieren Anchor-Texte, aber nicht den umliegenden Text – Googles Erkennung nutzt diese Asymmetrie aus.[16]
C
Natürliche, beschreibende Link-Texte sind besser als keyword-optimierte – lass verlinkende Seiten ihre eigenen Worte verwenden.[17]
B
Variierte interne Link-Texte reduzieren das Risiko, die phraseAnchorSpamPenalty auszulösen.[18]
P
Die Geschwindigkeit des Linkaufbaus ist entscheidend – plötzliche Spitzen lösen eine Analyse der zeitlichen Verteilung aus.[11]

06Quellen

Dieser Deep Dive ist Schicht-2-Content — interpretiert und belegt, aber immer zurückverweisend auf Schicht 1 (die Referenzebene). Jeder Claim ist einer Quelle mit Evidenzcode zugeordnet: [A] DOJ/vereidigtes Material, [B] Leak-Feld, [P] Patent, [O] offizielle Google-Kommunikation, [C] Interpretation.

© Thomas Wawra · Senior SEO Manager · wetter.com — ein Unternehmen von Funke Digital