Beste SEO-Analyse: der Qualitätsrahmen für belastbare Audits
Eine Scorecard mit 100 Punkten, mit der Sie kostenlose Checks, Agentur-Audits und interne SEO-Analysen nach Daten, Abdeckung und Umsetzbarkeit bewerten.
Die beste SEO-Analyse erkennen Sie nicht am eingesetzten Werkzeug, am Umfang des Berichts oder an der Punktzahl, die er Ihrer Website gibt. Sie erkennen sie an vier Eigenschaften: belastbaren Datenquellen, einer begründeten Abdeckung, nachvollziehbaren Belegen und einer Priorisierung, aus der ein Arbeitsplan wird.
Der folgende Rahmen bewertet deshalb die Analyse, nicht die Website. Mit ihm lassen sich ein kostenloser Schnellcheck, ein Agentur-Audit und eine interne Auswertung an denselben Maßstäben messen, bevor jemand Budget auf ihre Empfehlungen setzt.
Die Scorecard: 100 Punkte für die Aussagekraft
| Bereich | Prüffrage | Erwarteter Nachweis | Punkte |
|---|---|---|---|
| Datenqualität | Sind Quelle, Zeitraum, Umfang und Filter jeder wesentlichen Aussage dokumentiert? | Quellenverzeichnis, Exporte, Zeiträume | 10 |
| Datenqualität | Werden reale Nutzerdaten und Labordaten getrennt ausgewiesen? | Kennzeichnung je Messwert | 10 |
| Datenqualität | Werden die Grenzen der Daten benannt (Stichprobe, Abschneidegrenzen, fehlende Zugänge)? | Abschnitt zu Einschränkungen | 10 |
| Abdeckung | Ist begründet, welche Prüffelder untersucht wurden und welche bewusst nicht? | Prüfmatrix mit Ausnahmen | 15 |
| Abdeckung | Werden Befunde verknüpft statt nur aufgelistet? | Ursachenketten über Prüffelder hinweg | 10 |
| Nachvollziehbarkeit | Sind Befunde reproduzierbar und betroffene URLs eindeutig benannt? | URL-Listen, Abfragen, Messwerte | 10 |
| Nachvollziehbarkeit | Wurden automatisch erzeugte Hinweise durch Stichprobe oder zweite Quelle geprüft? | Prüfprotokoll, Beispiele | 10 |
| Nachvollziehbarkeit | Ist zu jedem Befund der Evidenzgrad ausgewiesen? | Bestätigt, wahrscheinlich, Hinweis | 5 |
| Umsetzbarkeit | Wird nach erwarteter Wirkung priorisiert statt nach Fehleranzahl? | Priorisierungsmatrix mit Annahmen | 10 |
| Umsetzbarkeit | Enthalten Empfehlungen Akzeptanzkriterien, Verantwortliche und Messgröße? | Tickets oder Maßnahmenpakete | 10 |
So bewerten Sie: je Zeile 0 Punkte für nicht vorhanden, die halbe Punktzahl für teilweise belegt, die volle Punktzahl für vollständig und belegt.
- 85 bis 100 Punkte: sehr belastbare Entscheidungsgrundlage
- 70 bis 84 Punkte: gut nutzbar, einzelne Nachweise fehlen
- 50 bis 69 Punkte: eingeschränkt belastbar, Lücken vor Maßnahmenbeginn schließen
- unter 50 Punkte: überwiegend Hinweise, kein Audit
Zwei Ausschlusskriterien stehen über der Summe. Erreicht eine Analyse in der Datenqualität oder in der Nachvollziehbarkeit weniger als die Hälfte der möglichen Punkte, ist sie unbrauchbar, egal wie viele Punkte die übrigen Bereiche liefern. Ohne saubere Datenbasis und ohne reproduzierbare Befunde optimieren Sie auf Vermutungen.
Wichtig: Diese Punktzahl beschreibt die Analyse. Sie ist kein Sichtbarkeitswert und kein Urteil über Ihre Website.
1. Datenqualität: Woher stammt die Aussage?
Jede wesentliche Feststellung braucht eine erkennbare Quelle, einen Zeitraum und einen Geltungsbereich. Für Aussagen über die Google-Suche ist die Google Search Console die zentrale Primärquelle; sie liefert unter anderem Klicks, Impressionen, Suchanfragen, Seiten und durchschnittliche Positionen. Genau deshalb muss der Bericht mitliefern, welcher Suchtyp, welcher Zeitraum und welche Filter zugrunde lagen. Fehlt das, lässt sich der Befund weder nachrechnen noch später kontrollieren.
Ebenso konsequent trennt eine gute Analyse Feld- und Labordaten. PageSpeed Insights kombiniert reale Nutzerdaten aus dem Chrome User Experience Report mit Labordaten aus Lighthouse; beide beantworten unterschiedliche Fragen. Ein Laborwert zeigt, was unter definierten Bedingungen passiert. Erst Felddaten zeigen, was Ihre Nutzer erleben.
Für die Core Web Vitals bewertet Google LCP, INP und CLS, mit LCP bis 2,5 Sekunden, INP bis 200 Millisekunden und CLS bis 0,1 als guten Grenzwerten. Belastbar wird die Bewertung erst über das 75. Perzentil der Seitenaufrufe, getrennt für Mobilgeräte und Desktop. Ein Bericht, der einen einzelnen Labor-Score pro Seite nennt und daraus einen Handlungsbedarf ableitet, hat diese Unterscheidung übersprungen.
Trennen Sie beim Lesen konsequent vier Ebenen: Beobachtung (eine URL erhielt 12.000 Impressionen und 40 Klicks), Interpretation (Snippet, Suchintention oder Position begrenzen die Klickrate), Validierung (Suchanfragen, Position und tatsächliches Suchergebnis wurden geprüft) und Empfehlung. Eine Analyse, die von Ebene eins direkt zu Ebene vier springt, verkauft Ihnen eine Vermutung als Befund.
2. Abdeckung: Was wurde geprüft, und was bewusst nicht?
Vollständigkeit heißt nicht, jedes denkbare Thema abzuarbeiten. Sie heißt, den Prüfumfang offenzulegen. Zu den üblichen Feldern gehören Crawlbarkeit, Indexierungsstatus, Informationsarchitektur und interne Verlinkung, Suchintention und inhaltliche Abdeckung, Titel und Snippets, strukturierte Daten, Seitenerfahrung und Performance, externe Signale sowie Messbarkeit. Welche davon entfallen, ist legitim, muss aber begründet sein.
Den Unterschied macht die Verknüpfung. Eine technisch fehlerfreie Seite kann ohne Suchnachfrage sein, eine inhaltlich starke Seite kann an einem Canonical, an fehlender interner Verlinkung oder an einem unbeabsichtigten Ausschluss scheitern. Wer Befunde nur nach Prüffeld sortiert auflistet, überlässt Ihnen die eigentliche Arbeit.
Auch scheinbar eindeutige Regeln brauchen Kontext. Eine robots.txt steuert das Crawling, verhindert aber nicht zuverlässig, dass eine URL in den Suchergebnissen erscheint. Ein Bericht, der jede gesperrte URL automatisch als deindexiert führt, ist an dieser Stelle schlicht falsch.
3. Nachvollziehbarkeit: Kann jemand den Befund wiederholen?
Eine Überschrift wie “Duplicate Content vorhanden” ist kein Befund. Ein Befund nennt die betroffenen URLs oder URL-Muster, Datum und Umfang der Erhebung, die Datenquelle, die konkrete Beobachtung, die vermutete Ursache und mögliche Gegenbeispiele.
Dazu gehört gelebte Validierung. Bei Indexierungsfragen zeigt das URL-Prüftool Informationen zur indexierten Version einer URL und führt auf Wunsch einen Live-Test der erreichbaren Seite aus. Das sind zwei verschiedene Antworten: Die aktuell ausgelieferte Seite muss nicht der zuletzt indexierten entsprechen. Wer beides vermischt, diagnostiziert am falschen Zustand.
Dieselbe Sorgfalt gilt für Standardmeldungen aus Crawlern. Google empfiehlt für jede indexierbare Seite einen beschreibenden, prägnanten und unterscheidbaren Seitentitel. Meta Descriptions dagegen kann Google für Snippets verwenden, erzeugt diese aber häufig automatisch aus dem Seiteninhalt. “300 fehlende Meta Descriptions” ist deshalb eine Zählung, keine Priorität, solange Seitentyp, Indexierbarkeit, Suchnachfrage und das real ausgespielte Snippet nicht geprüft wurden.
Machen Sie die Sicherheit sichtbar. Vier Stufen reichen: bestätigt (direkt reproduziert), wahrscheinlich (mehrere Datenpunkte), Hinweis (auffälliges Muster ohne Ursachennachweis), nicht bewertbar (Daten oder Zugang fehlen). Diese Kennzeichnung ist der wirksamste Schutz gegen Scheingenauigkeit, und sie kostet nichts.
4. Umsetzbarkeit: Wird daraus ein Arbeitsplan?
Die Anzahl gefundener Fehler taugt nicht zur Priorisierung. Ein Template mit 20.000 URLs vervielfacht denselben Fehler, während ein einzelner Defekt auf einer umsatztragenden Kategorie den größeren Schaden anrichtet. Bewerten Sie jede Empfehlung getrennt nach Wirkung, Reichweite, Aufwand und Diagnosesicherheit, dazu Dringlichkeit als eigene Dimension: Ein akuter Indexierungsfehler schlägt ein größeres Content-Vorhaben, auch wenn dessen Potenzial höher ist.
Umsetzbar ist eine Empfehlung erst, wenn sie Ergebnis, Akzeptanzkriterien, Verantwortliche, Abhängigkeiten, Aufwand und Messgröße benennt. Aus “interne Verlinkung verbessern” wird dann: “Jede indexierbare Ratgeberseite erhält mindestens einen kontextuellen Link von einer thematisch passenden Hub-Seite. Die Links sind serverseitig im HTML enthalten, crawlbar und tragen einen beschreibenden Ankertext.”
Die drei Ausgangslagen richtig einordnen
Kostenlose Checks punkten selten über 30. Sie liefern Hinweise auf Prüffeldebene, ohne Validierung und ohne Priorisierung. Das ist kein Mangel, solange Sie das Ergebnis als Suchhilfe behandeln und nicht als Audit.
Agentur-Audits scheitern erfahrungsgemäß weniger an der Abdeckung als an Nachvollziehbarkeit und Akzeptanzkriterien. Fordern Sie deshalb vor Beauftragung Rohdatenexporte, URL-Listen und ein Musterticket an, nicht ein Beispiel-PDF.
Interne Analysen haben die beste Datenlage und die schwächste Dokumentation, weil das Kontextwissen im Kopf bleibt. Hier zahlt sich die Scorecard doppelt aus: Was nicht aufgeschrieben ist, ist bei der nächsten Auswertung nicht mehr überprüfbar.
Warnzeichen
Skeptisch sollten Sie werden, wenn eine Analyse eine einzelne Kennzahl als Gesamturteil führt, Datenquellen und Zeiträume verschweigt, automatische Meldungen ungeprüft übernimmt, alle Fehler eines Typs gleich priorisiert, Wirkung ohne offengelegte Annahmen verspricht, Korrelationen als Ursachen darstellt oder Rankings garantiert. Organische Ergebnisse hängen von Wettbewerb, Nachfrage, Umsetzung und den Suchsystemen selbst ab.
Die beste SEO-Analyse ist damit kein Produkt und kein möglichst dicker Fehlerbericht. Sie ist eine belegte, reproduzierbare und priorisierte Entscheidungsgrundlage, die ihre eigenen Unsicherheiten benennt.
