Startseite › SEO-Leitfaden › Wie eine Website aussieht, die Google lesen kann
Wie eine Website aussieht, die Google lesen kann
Eine für Google lesbare Website ist eine, bei der der Crawler denselben Text und dieselben Links erhält, die Sie im Browser sehen, statt einer nachträglich per Code erzeugten Version. In einem realen Fall enthielt der Code, den Google für eine Website mit 18 Artikeln erhielt, nur 4 interne Adressen, alle zur Startseite; nach der Korrektur waren es 22.
Der Kerngedanke dieses Kapitels passt in einen Satz: Was Sie auf Ihrer Website sehen, ist nicht unbedingt das, was Google erhält. Und wenn sich die beiden unterscheiden, zeigt sich der Unterschied nirgends. Die Website sieht gut aus, niemand beschwert sich, und die Seiten ranken nicht.
Warum sie sich unterscheiden können
Ihr Browser tut viel mehr, als eine Datei anzuzeigen. Er führt Code aus, fordert zusätzliche Daten an, baut Teile der Seite erst auf, nachdem Sie auf ihr gelandet sind. Ein Suchmaschinen-Bot erhält zuerst den rohen Text und führt erst danach, vielleicht, den Code aus.
Außerdem liefern viele Websites bewusst unterschiedliche Antworten aus: eine Version für eingeloggte Besucher, eine andere für anonyme, eine andere aus dem Cache, eine andere für Bots. Jede dieser Varianten kann für sich allein kaputt sein, ohne dass die anderen ein Anzeichen dafür geben.
Erster Fall: eine ganze Website ohne interne Links
Auf zwei Versicherungs-Websites, die auf derselben Plattform gebaut sind, haben wir entdeckt, dass jeder interne Link in der an Bots ausgelieferten Version auf die Startseite zeigte.
Die Artikelkarte sah in dem Code, den der Googlebot erhielt, so aus:
<h2 class="titlu"><a href="/">Wie Sie die passende RCA-Police wählen</a></h2>
Der Titel richtig, die Adresse falsch. Eine der Websites hatte 18 veröffentlichte Artikel, und keiner war über einen Link erreichbar. Die Startseite hatte insgesamt vier verschiedene interne URLs, davon drei zu rechtlichen Seiten.
Die Ursache: Die Website baut die URLs mit einer Funktion, die die Liste der Routen braucht. Diese Liste war nur im Browser verfügbar. Beim Rendern auf dem Server hatte jemand einen Ersatz eingesetzt, der für jede angefragte Adresse die Startseite zurückgab, damit das Rendern nicht mit einem Fehler abbricht. Es brach nicht ab. Es erzeugte stillschweigend eine Website ohne Struktur.
Die Besucher sahen nichts Ungewöhnliches. Der Code lief im Browser, die Links korrigierten sich sofort, alle navigierten ganz normal.
Nur Google und die KI-Assistenten, die keinen Code ausführen, bekamen die kaputte Variante. Also genau diejenigen, für die interne Links zählen.
Nach der Reparatur stieg die Startseite von 4 auf 22 interne URLs, und die Artikel wurden erreichbar. Ein nützlicher Nebeneffekt: Die Kontaktseite wurde von selbst verlinkt, weil das Menü dieselbe defekte Funktion benutzte.
Zweiter Fall: ein Häkchen, das die Links leert
Auf vier Websites enthielt die Autorenbox unter den Artikeln einen Link ohne Ziel:
<a href="" rel="author">Name des Autors</a>
Die Ursache war eine einzige angehakte Option in einem sehr verbreiteten Plugin, die die Autorenseiten deaktiviert. Das Plugin hat die Seiten deaktiviert, aber das Template hat weiter den Link zu ihnen erzeugt. Das Ergebnis: ein leerer Link auf jedem Artikel.
Ein Besucher, der darauf klickt, bleibt an Ort und Stelle und denkt, die Seite sei hängen geblieben. Ein Bot sieht eine Signatur, die nirgendwohin führt, also einen Autor, den er nicht überprüfen kann.
Der zweite Fall aus derselben Familie, und noch lehrreicher, weil es unser Fehler ist. Auf zwei Websites hatten wir eine Sicherheitsregel geschrieben, die den Zugriff auf einen bestimmten Adresstyp blockierte, um eine Methode zum automatischen Absammeln von Benutzernamen einzuschränken. Die Regel war in der Absicht richtig und in der Formulierung zu breit: Sie blockierte auch die legitimen Autorenseiten, die auf die Startseite weitergeleitet wurden.
Wir hatten also gleichzeitig eine Autorenbox, die irgendwohin verwies, und eine eigene Regel, die dafür sorgte, dass dieses Irgendwo nicht existierte. Beide in guter Absicht geschrieben, beide ohne Überprüfung unsichtbar.
Was „lesbar“ in der Praxis bedeutet
| Element | Wozu es dient |
|---|---|
| Interne Links | Sie sind die Wege, über die man zu Ihren Seiten gelangt. Eine Seite, zu der kein Link führt, ist eine Seite, die fast nicht existiert |
| Seitentitel und Beschreibung | Sie sind das, was man in den Ergebnissen liest, bevor man die Seite aufruft. Jede Seite braucht ihre eigenen, jeweils unterschiedliche |
| Eine einzige Hauptüberschrift | Sagt, worum es auf der Seite geht. Die Zwischenüberschriften ordnen den Rest, der Reihe nach |
| Strukturierte Daten | Übersetzen in Maschinensprache, was die Seite ist: Artikel, Produkt, Firma, Autor. Sie heben die Position nicht von allein, aber sie machen die Information unbestreitbar |
| Der Text zu Bildern | Die Alternativbeschreibung. Ein Bot sieht das Foto nicht, und ein Mensch, der einen Screenreader benutzt, erst recht nicht |
Wie Sie selbst prüfen, ohne Werkzeuge
Drei Methoden, in der Reihenfolge des Aufwands.
Die Suche auf der eigenen Website
Geben Sie bei Google site:ihre-domain.ro ein. Sie erhalten die ungefähre Liste der bekannten Seiten. Wenn die Zahl viel kleiner ist als das, was Sie tatsächlich haben, haben Sie ein Zugriffsproblem, kein Inhaltsproblem.
Die Anzeige des Quelltexts
Klicken Sie auf einer beliebigen Seite mit der rechten Maustaste und wählen Sie die Anzeige des Seitenquelltexts. Es öffnet sich der rohe Text, also ungefähr das, was ein Bot erhält, bevor er Code ausführt. Suchen Sie darin mit der Suchfunktion des Browsers nach einem Ausschnitt aus dem Haupttext der Seite. Wenn Sie ihn dort nicht finden, wird der Inhalt nachträglich aufgebaut, und das ist eine Diskussion wert.
Das URL-Prüftool der Search Console
Das beste der drei, weil es Ihnen genau das zeigt, was Google gesehen hat. Fügen Sie die URL einer Seite in die Leiste oben ein, und Sie erfahren, ob sie indexiert ist, wann sie zuletzt besucht wurde und auf welche Probleme Google gestoßen ist.
Die Regel, die das ganze Kapitel zusammenfasst: Keines der oben genannten Probleme ist beim normalen Surfen auf der Website zu sehen.
Eine Website kann perfekt aussehen und gleichzeitig für die Suchmaschine unlesbar sein, die Ihnen Kunden bringen soll. Deshalb ist die Überprüfung nicht optional, und „bei mir im Browser sieht es gut aus“ ist kein Argument.
Zu prüfen
- Suchen Sie nach
site:ihre-domain.round vergleichen Sie die Zahl der Ergebnisse mit der tatsächlichen Zahl der Seiten. - Öffnen Sie den Quelltext der Startseite und suchen Sie darin nach einem Satz aus dem sichtbaren Text.
- Klicken Sie auf einem Artikel auf den Namen des Autors und auf einen der Links im Menü. Führen sie wirklich irgendwohin?
- Öffnen Sie die Search Console und lesen Sie den Indexierungsbericht: wie viele Seiten indexiert sind und wie viele nicht, mit dem Grund.
- Wenn die Website auf einer Plattform gebaut ist, die im Browser rendert, verlangen Sie ausdrücklich, dass man Ihnen zeigt, was ein Bot erhält. Das ist eine Prüfung von zehn Minuten.