IS-Kalibrierung: Das Human-Rater-System, das Googles Qualitätsmodelle trainiert
Die stärkste Evidenz im gesamten Matrix — DOJ/Eid-Material bestätigt das Rater-System, das jedes Qualitäts-Signal kalibriert, das Google nutzt
01Was ist IS-Kalibrierung?
IS-Calibration ist kein Live-Ranking-Signal – es ist die Grundlage, auf der alle Qualitätsmodelle kalibriert werden. Der IS-Score (Information Satisfaction) fasst zusammen, wie gut eine Seite den Informationsbedarf eines Nutzers erfüllt, bewertet von geschulten menschlichen Ratern. Die Quality Rater Guidelines (QRG) definieren die Standards, die diese Rater anwenden.
Dieses System hat den härtesten Evidenzcode in der gesamten Matrix: [A] (DOJ/beeidetes Material). Der DOJ-Kartellprozess bestätigte, dass menschliche Rater eine zentrale Rolle im Ranking von Google spielen – nicht indem sie Seiten direkt ranken, sondern indem sie die Machine-Learning-Modelle kalibrieren, die dies tun.
Die QRG ist öffentlich zugänglich – Google veröffentlicht das Dokument, das seine Rater verwenden. Diese Transparenz ist für eine Ranking-System-Komponente ungewöhnlich, ergibt aber Sinn: Die QRG definiert konzeptionell, was 'Qualität' bedeutet, und Google möchte, dass die SEO-Community versteht, wonach Rater suchen.
02Wie Rater-Kalibrierung funktioniert
Googles Rater-System funktioniert durch eine Feedback-Schleife. Erstens wählt Google eine Stichprobe von Suchergebnissen für bestimmte Suchanfragen aus. Zweitens bewerten trainierte menschliche Rater diese Ergebnisse gemäß den QRG – sie bewerten Seiten nach Qualität (E-E-A-T) und Bedürfniserfüllung (erfüllt die Seite das Bedürfnis des Nutzers?). Drittens vergleicht Google die Rater-Urteile mit den Vorhersagen seines Machine-Learning-Modells. Viertens passt Google das Modell an, um die Rater-Urteile besser widerzuspiegeln.
Diese Kalibrierung ist ein fortlaufender Prozess – kein einmaliges Training. Google sammelt kontinuierlich Rater-Urteile und nutzt sie zur Verfeinerung seiner Qualitätsmodelle. Der DOJ-Prozess bestätigte dies: Googles VP of Search sagte aus, dass das Unternehmen erhebliche Ressourcen für das Human Rating aufwendet und dass Rater-Daten zur Verbesserung der Suchqualität verwendet werden.
Die architektonische Bedeutung von IS-Calibration liegt darin, dass es in fünf nachgelagerte Systeme einfließt (fedBy ist leer, feedsInto: [8, 9, 10, 11, 16]). Diese nachgelagerten Systeme – chard (Inhaltsqualität), contentEffort (redaktioneller Aufwand), Topic-Embedding (thematische Relevanz), OriginalContentScore (Originalität des Inhalts) und Panda (Website-Qualität) – sind alle auf die Rater-Kalibrierung angewiesen, um zu funktionieren. Ohne IS-Calibration hätten diese Qualitätsmodelle keine Ground Truth, aus der sie lernen könnten.
03Die QRG: worauf Rater achten
Die Quality Rater Guidelines definieren spezifische Kriterien zur Bewertung von Seiten. Rater bewerten E-E-A-T (Experience, Expertise, Authoritativeness, Trustworthiness), wobei Trust die wichtigste Dimension darstellt. Sie bewerten außerdem Needs Met: Erfüllt die Seite die Suchabsicht des Nutzers, erfüllt sie diese teilweise, oder wird sie nicht erfüllt?
Die QRG unterscheidet zwischen verschiedenen Seitentypen: Main Content (MC), Supplementary Content (SC) und Ads/Money-Making Content. Die Qualität des Main Content ist der primäre Faktor – Supplementary Content kann ihn ergänzen oder beeinträchtigen, aber schwachen Main Content nicht ausgleichen.
Für YMYL-Seiten (Your Money Your Life) legt die QRG höhere Standards fest. Medizinische, finanzielle und rechtliche Inhalte müssen ein höheres E-E-A-T nachweisen als Unterhaltungs- oder Hobbyinhalte. Dies ist kein eigenständiges Ranking-System – es ist ein Kalibrierungsstandard, den IS-Calibration auf Qualitätsmodelle wie chard anwendet.
04IS-Kalibrierung in der Ranking-Architektur
IS-Calibration ist das einzige System, das in allen vier E-E-A-T-Dimensionen primär ist: Experience (E: primär), Expertise (Exp: primär), Authoritativeness (A: primär) und Trustworthiness (T: primär). Dies spiegelt seine Rolle als universelle Qualitätsgrundlage wider – Rater-Urteile definieren, was alle vier Dimensionen in der Praxis bedeuten.
Architektonisch gesehen ist IS-Calibration eine Quelle, kein Transformator. Es hat keine vorgelagerten Abhängigkeiten (fedBy ist leer) – Rater-Urteile sind primäre Daten, abgeleitet aus menschlicher Bewertung, nicht aus anderen Ranking-Signalen. Es speist fünf nachgelagerte Systeme und ist damit eines der am stärksten vernetzten Systeme in der Matrix.
Das Feld siteQualityStddev (Standardabweichung der Website-Qualität) misst die Konsistenz der Qualität auf einer Website. Eine Website mit hoher Varianz in den Rater-Bewertungen – einige hervorragende Seiten, einige schlechte – kann anders behandelt werden als eine Website mit durchgehend mittelmäßigen Bewertungen. Dies fließt in Pandas websiteweite Qualitätsbewertung ein.
05Implikationen für SEO-Praktiker
Das Rater-Kalibrierungssystem bedeutet, dass SEO letztendlich darum geht, menschliche Evaluatoren zu befriedigen, nicht Algorithmen. Googles Qualitätsmodelle werden trainiert, um vorherzusagen, was ein geschulter Rater über eine Seite sagen würde. Wenn Sie optimieren, was die QRG beschreibt – echte Expertise, klare Autorenschaft, hilfreicher Hauptinhalt, angemessene YMYL-Behandlung – optimieren Sie für das System, das jedes Qualitätssignal kalibriert, das Google verwendet.
Die QRG ist das umsetzbarste Dokument in Googles gesamtem Ranking-Ökosystem. Im Gegensatz zum Algorithmus (der proprietär ist) ist die QRG öffentlich, detailliert und wird regelmäßig aktualisiert. Sie definiert genau, was 'Qualität' für Google bedeutet, und jedes Qualitätsmodell in Googles System wird kalibriert, um ihr zu entsprechen.
Die Unterscheidung zwischen Page Quality und Needs Met ist entscheidend. Eine Seite kann eine hohe Qualität aufweisen (gut recherchiert, autoritativ, vertrauenswürdig) und dennoch den Bedarf des Nutzers für eine bestimmte Suchanfrage nicht erfüllen. Umgekehrt könnte eine Seite mit geringerer Qualität einen bestimmten Bedarf perfekt erfüllen. Google bewertet diese getrennt – hohe Qualität allein reicht nicht für gute Rankings aus, wenn die Seite die Suchanfrage nicht befriedigt.
06Quellen
DOJ / Vereidigtes Material (2)
- [2]ADOJ-Prozess — Rater-System-Rolle bestätigt
- [6]ADOJ-Prozess — Pandu Nayak Aussage ↗
API Leak (4)
- [1]BGoogle API Leak — Systembeschreibung ↗
- [5]BGoogle API Leak — feedsInto: [8, 9, 10, 11, 16]
- [10]BGoogle API Leak — dims: alle primär
- [11]BGoogle API Leak — siteQualityStddev-Feld ↗
Quality Rater Guidelines (7)
- [3]OGoogle offizielle Veröffentlichung der Quality Rater Guidelines ↗
- [4]OQRG — 'Page Quality und Needs Met werden getrennt bewertet, nie gemittelt' ↗
- [7]OQRG — 'Trust ist das wichtigste Mitglied der E-E-A-T-Familie' ↗
- [8]OQRG — Seitenstruktur-Bewertungskriterien ↗
- [9]OQRG — YMYL-Abschnitt ↗
- [13]OQRG — öffentlich verfügbar, detailliert, regelmäßig aktualisiert ↗
- [14]OQRG — getrennte Bewertungsskalen ↗