SEO Ranking Faktoren für Deutschland 2012: was die Studie zeigte und was sie nicht belegt
Die deutsche Ranking-Faktoren-Studie von 2012 im Rückblick: Datenbasis, Methodik, Google-Updates und warum ihre Korrelationen keine Empfehlung sind.
Die für Deutschland veröffentlichte Ranking-Faktoren-Untersuchung von 2012 war eine Korrelationsstudie, keine Liste von Googles Algorithmus-Regeln. Sie verglich Merkmale von Seiten mit deren Positionen in den organischen Suchergebnissen und hielt fest, welche Eigenschaften bei gut platzierten Seiten häufiger auftraten. Laut den damaligen Zusammenfassungen lag der Auswertung eine Basis von 10.000 Keywords und rund 300.000 Websites beziehungsweise URLs zugrunde. Wer diese Zahlen heute liest, liest ein Zeitdokument: Es beschreibt, wie deutsche Suchergebnisse im Jahr 2012 aussahen, und nicht, was eine Seite heute nach oben bringt.
Dieser Text rekonstruiert die Studie in ihrem eigenen Jahr. Er ordnet ein, was gemessen wurde, welche Aussagekraft die Methodik zulässt, welche Google-Updates 2012 parallel liefen, und warum aus den damaligen Befunden keine aktuellen Handlungsempfehlungen abgeleitet werden sollten.
Was 2012 überhaupt untersucht wurde
Der Untersuchungsaufbau folgte einem Muster, das in der Branche seinerzeit neu war und schnell Schule machte. Man nimmt eine große, möglichst repräsentative Menge an Suchanfragen, erhebt für jede Anfrage die vorderen organischen Suchergebnisse, misst an jeder dieser URLs eine Reihe von Merkmalen und prüft anschließend, ob ein Merkmal systematisch mit besseren oder schlechteren Positionen zusammenfällt.
Die Merkmale stammten aus den gängigen Kategorien der damaligen Suchmaschinenoptimierung:
- Offpage-Merkmale: Anzahl und Art eingehender Links, Verteilung der Linkquellen, Ankertexte.
- Onpage-Merkmale: Vorkommen des Keywords in Titel, Überschriften, URL und Fließtext, technische Eigenschaften der Seite, Umfang des Textes.
- Nutzer- und Plattformsignale: Erwähnungen und Interaktionen auf sozialen Netzwerken, die zu dieser Zeit intensiv als möglicher Rankingeinfluss diskutiert wurden.
Diese Kategorien sind bis heute die grobe Landkarte, auf der SEO sich bewegt. Die Studie hat sie nicht erfunden, aber sie hat ihnen erstmals für den deutschen Markt Zahlen gegeben, über die sich diskutieren ließ. Genau darin lag ihr Wert und zugleich ihr Risiko.
Die Datenbasis in ihrem Kontext
10.000 Keywords und rund 300.000 URLs waren für 2012 eine beachtliche Menge. Sie sind aber kein Querschnitt durch das gesamte deutsche Suchvolumen, und sie sagen nichts darüber, wie die Keywords ausgewählt wurden, welche Branchen überrepräsentiert waren oder wie sich Marken- und Longtail-Anfragen verteilten. Eine Korrelationsstudie ist immer nur so allgemein wie ihr Keyword-Set. Wer die Ergebnisse von damals zitiert, zitiert streng genommen die Struktur dieses Sets, nicht die Suche als Ganzes.
Die Methodik: Rangkorrelation ist kein Kausalnachweis
Der zentrale methodische Punkt entscheidet über alles Weitere. Die Studie berichtete statistische Zusammenhänge zwischen Merkmalen von Seiten und ihren Positionen in den organischen Suchergebnissen. Solche Rang-Korrelationen belegen für sich allein keine kausale Rankingwirkung.
Der Unterschied lässt sich an einem Beispiel zeigen, das nichts mit Suchmaschinen zu tun hat: In Städten mit vielen Feuerwehreinsätzen gibt es auch viele Brandschäden. Niemand würde daraus schließen, dass die Feuerwehr Brände verursacht. Beide Größen hängen an einer dritten, nämlich der Zahl und Dichte der Gebäude. In der Suche ist die dritte Größe oft schlicht: eine etablierte, bekannte, viel besuchte Marke. Solche Websites haben mehr Links, mehr Social-Erwähnungen, längere Texte, saubere Technik und bessere Positionen. Jedes einzelne dieser Merkmale korreliert dann mit dem Ranking, ohne dass eines davon das Ranking erzeugt haben muss.
Drei Kategorien, die auseinandergehalten werden müssen
Die moderne Einordnung von Rankingfaktoren unterscheidet ausdrücklich zwischen beobachteter Korrelation, möglicher Ursache und bloßen Begleitmerkmalen erfolgreicher Seiten. Diese Dreiteilung ist das schärfste Werkzeug beim Lesen der 2012er-Zahlen:
- Beobachtete Korrelation. Das Merkmal tritt bei besser platzierten Seiten häufiger oder ausgeprägter auf. Mehr sagt die Messung nicht.
- Mögliche Ursache. Es gibt einen plausiblen, idealerweise durch Google selbst bestätigten Mechanismus, über den das Merkmal auf die Bewertung wirkt.
- Begleitmerkmal. Das Merkmal ist eine Folge des Erfolgs oder eine Folge derselben Ursache, nicht sein Auslöser.
Die Studie von 2012 konnte per Konstruktion nur Punkt eins liefern. Ein großer Teil der öffentlichen Rezeption hat daraus Punkt zwei gemacht. Das ist der eigentliche historische Lerneffekt dieser Studie, und er ist wertvoller als jede einzelne Kennzahl darin.
Weitere methodische Grenzen
Neben der Kausalitätsfrage gelten für Korrelationsstudien dieser Bauart mehrere Einschränkungen, die man 2012 noch weniger routiniert mitdachte als heute:
- Die Messung ist ein Standbild. Suchergebnisse werden zu einem Zeitpunkt erhoben. Ändert sich das Ranking-System danach, veraltet der Befund, ohne dass die Zahl ihr Aussehen ändert.
- Personalisierung und Lokalisierung verzerren. Was gemessen wird, hängt vom Standort, der Sprachregion und den Erhebungsbedingungen des Crawlers ab.
- Aggregation glättet Unterschiede. Ein über alle Branchen gemittelter Zusammenhang kann in einzelnen Themenfeldern genau umgekehrt ausfallen.
- Nicht Messbares fehlt. Merkmale, die sich von außen nicht erheben lassen, tauchen in keiner Tabelle auf. Ihr Fehlen ist kein Beleg für ihre Bedeutungslosigkeit.
Die Befunde von 2012 im Überblick
Backlinks blieben der dominante Faktor, der Link-Mix rückte nach vorn
Backlinks wurden in der damaligen Auswertung weiterhin als besonders relevant beschrieben, wobei ein natürlicher beziehungsweise vielfältiger Link-Mix stärker in den Fokus rückte. Das ist inhaltlich die interessanteste Verschiebung des Jahrgangs. Die reine Masse an Verweisen verlor an Erklärungskraft gegenüber der Frage, wie unterschiedlich und wie organisch ein Linkprofil zusammengesetzt war.
Für die zeitgenössische Praxis bedeutete das eine Zäsur. Die Jahre davor waren von Methoden geprägt, die auf Wiederholung setzten: identische Ankertexte in großer Zahl, immer dieselben Quelltypen, maschinell erzeugte Verzeichnisse. Die Auswertung von 2012 legte nahe, dass sich diese Muster von gewachsenen Profilen unterscheiden ließen. Im Rahmen dieser Seite bleibt das ein Studienergebnis von 2012 und ausdrücklich keine Anleitung: Wie Linkaufbau heute zu bewerten ist, ist eine andere Frage mit anderen Antworten.
Soziale Signale: der meistdiskutierte Befund des Jahrgangs
Zeitgenössische Berichte zur Searchmetrics-Auswertung hoben hervor, dass soziale Signale 2012 deutlich mit guten Rankings korrelierten. Keine andere Zahl der Studie wurde so breit aufgegriffen, und keine hat so viel Fehlinterpretation ausgelöst.
Der Befund als solcher ist unstrittig: Seiten, die auf sozialen Netzwerken häufig geteilt wurden, standen in den untersuchten Suchergebnissen im Schnitt weiter oben. Umstritten war von Anfang an die Deutung. Die naheliegende Gegenerklärung lautet, dass beliebte Inhalte beides auslösen, Shares und Verlinkungen, und dass die Suchmaschine auf die Verlinkungen reagiert, nicht auf die Shares. Hinzu kommt die Frage der Zugänglichkeit: Ein erheblicher Teil der Interaktionen auf sozialen Plattformen war für einen Crawler gar nicht oder nur eingeschränkt sichtbar.
Die Studie konnte zwischen diesen Erklärungen nicht entscheiden, und sie behauptete es in ihrer methodischen Anlage auch nicht. Die Branche hat den Unterschied trotzdem über Jahre eingeebnet. Wer heute verstehen will, wie eine Korrelationszahl zu einer geglaubten Regel wird, findet hier den Musterfall.
Onpage-Merkmale als Einordnung der Studienkategorien
Die klassischen Onpage-Merkmale, also Keyword im Titel, in Überschriften und in der URL, erschienen in der Auswertung, fielen in ihrer Korrelationsstärke aber gegenüber den Offpage-Werten ab. Auch das ist ein typisches Artefakt der Methode und nicht zwingend eine Aussage über Wichtigkeit: Merkmale, die praktisch jede optimierte Seite erfüllt, können kaum zwischen Position 1 und Position 10 trennen. Ein Faktor mit geringer Streuung erzeugt eine niedrige Korrelation, selbst wenn er eine notwendige Grundbedingung ist. Die Unterscheidung von Onpage und Offpage dient hier ausschließlich der Gliederung der Studienkategorien; als eigenständiges Grundlagenthema wird sie an anderer Stelle behandelt.
Das Jahr 2012: was parallel zur Studie im Algorithmus geschah
Eine Korrelationsstudie misst einen Zustand. 2012 war aber ein Jahr, in dem sich dieser Zustand bewegte, und zwar sichtbar.
Die Webspam-Ankündigung vom 24. April 2012
Google kündigte am 24. April 2012 eine Algorithmusänderung gegen Webspam an, die später als Penguin Update bekannt wurde und insbesondere manipulative Optimierungsmethoden treffen sollte. Die Ankündigung im offiziellen Blog für Suchentwickler richtete sich ausdrücklich gegen Techniken, die über normale Optimierung hinausgingen, und belohnte im Gegenzug hochwertige Seiten.
Für die Lesart der Ranking-Faktoren-Studie hat dieses Datum eine besondere Bedeutung. Es markiert den Punkt, an dem bestimmte Link-Muster nicht mehr nur schwächer wirkten, sondern aktiv zum Problem werden konnten. Damit hängt die Interpretierbarkeit vieler Offpage-Zahlen des Jahres daran, ob sie vor oder nach diesem Einschnitt erhoben wurden. Eine Korrelation, die im März gültig war, kann im Mai eine andere Bedeutung gehabt haben.
Die Listen der Suchänderungen
Google veröffentlichte 2012 regelmäßig Listen von Änderungen an der Suche. Die Zusammenstellung vom Juni jenes Jahres führte allein 39 Änderungen auf. Diese Veröffentlichungen zeigen, dass sich Ranking-Systeme parallel zur damaligen Korrelationsstudie fortlaufend weiterentwickelten, in einer Taktung von Wochen, nicht von Jahren.
Daraus folgt eine nüchterne Einsicht über den Charakter jeder Momentaufnahme: Das gemessene Objekt stand nicht still, während gemessen wurde. Die Studie beschreibt ein bewegtes Ziel mit den Mitteln eines Fotos. Das entwertet sie nicht, aber es begrenzt ihre Haltbarkeit von vornherein, und zwar auf wenige Monate, nicht auf ein Jahrzehnt.
Warum die Zahlen von 2012 heute keine Empfehlung mehr tragen
Zwischen der Studie und der Gegenwart liegen mehrere grundlegende Umbauten der Suche. Die Suchergebnisseite selbst sieht anders aus, die Auswertung von Sprache und Bedeutung funktioniert anders, die Gewichtung von Nutzersignalen und Qualitätsbewertungen hat sich verschoben, und die mobile Nutzung hat die Rahmenbedingungen der Messung verändert. Jede einzelne dieser Verschiebungen macht einen Teil der damaligen Merkmalsliste unvergleichbar.
Hinzu kommt ein Effekt, den man leicht übersieht. Sobald eine Korrelationsstudie breit rezipiert wird, verändert sie das Verhalten der Optimierer und damit die Datenlage der nächsten Erhebung. Wenn alle das Merkmal mit der höchsten berichteten Korrelation bearbeiten, sinkt dessen Streuung und damit dessen Korrelation im Folgejahr. Ranking-Faktoren-Studien messen also immer auch die Rezeption ihrer Vorgänger mit.
Die richtige Frage an die Studie von 2012 lautet deshalb nicht, welche ihrer Zahlen heute noch gilt. Sie lautet: Was war damals der Stand des Wissens, mit welchen Mitteln wurde er erhoben, und wo ist die Branche bei der Deutung über das hinausgegangen, was die Daten hergaben.
Wie eine historische Korrelationsstudie sachgerecht zitiert wird
Wer die Studie in einem Fachtext, einer Präsentation oder einer Recherche verwendet, kommt mit einer kurzen Prüfliste weit:
- Jahr und Markt immer mitnennen. Es handelt sich um eine Auswertung für Deutschland aus dem Jahr 2012, nicht um einen allgemeingültigen Befund.
- Die Datenbasis nennen. 10.000 Keywords und rund 300.000 Websites beziehungsweise URLs laut den damaligen Zusammenfassungen, mit den oben beschriebenen Grenzen der Repräsentativität.
- Die Methodik benennen. Rangkorrelation zwischen Seitenmerkmalen und Positionen, kein Experiment, keine Kausalaussage.
- Den Update-Kontext erwähnen. Das Jahr enthielt mit der Webspam-Ankündigung vom 24. April 2012 und einer laufenden Folge dokumentierter Suchänderungen mindestens einen relevanten Einschnitt.
- Keine Gegenwartsaussage ableiten. Der Satz “die Studie zeigt, dass X rankt” ist in dieser Form auch für 2012 nicht gedeckt und für heute doppelt unzulässig.
Was von der Studie bleibt
Der bleibende Beitrag der deutschen Ranking-Faktoren-Auswertung von 2012 liegt weniger in ihren Einzelwerten als in drei Dingen.
Erstens hat sie die Debatte über Rankingfaktoren im deutschsprachigen Raum von Anekdoten auf Daten umgestellt. Auch eine methodisch begrenzte Zahl ist ein besserer Diskussionsgegenstand als eine Behauptung.
Zweitens hat sie den Blick auf das Linkprofil verschoben, weg von der Menge und hin zur Zusammensetzung. Diese Verschiebung fiel zeitlich mit Googles eigener Ankündigung gegen manipulative Methoden zusammen, was beiden Entwicklungen zusätzliches Gewicht gab.
Drittens, und am nachhaltigsten, hat sie als Anschauungsmaterial dafür gedient, wie aus einer Korrelation im öffentlichen Umlauf eine vermeintliche Ursache wird. Der Umgang mit den sozialen Signalen von 2012 ist bis heute das Standardbeispiel dafür. Dass die saubere Trennung von Korrelation, möglicher Ursache und bloßem Begleitmerkmal inzwischen zum festen Bestandteil jeder ernsthaften Definition von Rankingfaktoren gehört, ist nicht zuletzt eine Lehre aus Studien dieses Jahrgangs.
Als historische Quelle ist die Untersuchung damit weiterhin interessant. Als Grundlage für Entscheidungen über eine Website ist sie abgelaufen, und zwar seit deutlich mehr als einem Jahrzehnt.
