Transparenz
So funktionieren unsere Checks
1. Abrufen
Unser eigener Crawler seoboxbot fordert die Adresse an und speichert drei Dinge:
- die Server-Antwort mit Statuscode (z. B. 200, 301, 404, 500), Weiterleitungen und HTTP-Headern,
- den HTML-Quelltext,
- die Ladezeit.
Bei Weiterleitungen folgt er jedem Sprung einzeln und protokolliert die ganze Kette. Ausgewertet wird der ausgelieferte HTML-Quelltext. Inhalte, die eine Seite erst nachträglich per JavaScript lädt, berücksichtigen wir derzeit nicht.
2. Zerlegen
Aus dem HTML lesen wir die Elemente, die für Suchmaschinen wichtig sind: Title, Meta-Description, Überschriften H1 bis H6, Canonical, robots-Meta-Tag, hreflang, strukturierte Daten (JSON-LD), Bilder mit Alt-Texten, alle internen und externen Links sowie den sichtbaren Text.
3. Prüfen gegen Regeln
Jede Regel ist ein einfacher Test mit Schwellenwert:
| Check | Regel |
|---|---|
| Title | vorhanden, höchstens rund 580 Pixel breit, nicht doppelt auf mehreren Seiten |
| Indexierbarkeit | kein „noindex“, nicht durch robots.txt gesperrt, Canonical zeigt auf sich selbst |
| Weiterleitungen | höchstens ein Sprung, 301 statt 302, keine Schleife |
| Links | jedes Linkziel antwortet mit 200 |
| Bilder | jedes Bild hat einen Alt-Text |
| Inhalt | mindestens rund 300 Wörter eigener Text |
| Strukturierte Daten | JSON-LD gültig, Pflichtfelder des jeweiligen Typs vorhanden |
Warum Pixel statt Zeichen?
Die Breite eines Titels bestimmen wir nicht über die Zeichenzahl, sondern mit den Zeichenbreiten der Schrift, die Google in den Suchergebnissen verwendet. Zehnmal „W“ ist 189 Pixel breit, zehnmal „i“ nur 44 Pixel.
Einzeltool und Monatsbericht
Die kostenlosen Tools führen diese Schritte für genau eine Adresse aus, sofort und im Browser sichtbar. Der Monatsbericht macht dasselbe für die ganze Website:
- Der Crawler beginnt auf der Startseite und in der XML-Sitemap und folgt jedem internen Link, bis alle erreichbaren Seiten erfasst sind oder die Grenze Ihres Pakets erreicht ist.
- Jede Seite durchläuft alle Regeln. Daraus entstehen Befunde wie „23 Seiten ohne Meta-Description“.
- Dazu kommen seitenübergreifende Prüfungen: doppelte Titel, verwaiste Seiten ohne internen Link, Seiten mehr als vier Klicks von der Startseite entfernt.
- Externe Daten werden abgefragt: Ladezeiten über die PageSpeed-Schnittstelle und – sobald die Anbindung verfügbar ist und Sie sie freigeben – Suchbegriffe und Klicks aus Ihrer Google Search Console.
Priorisierung
Jeder Befundtyp hat ein festes Gewicht für Wirkung und eines für Aufwand. Ein „noindex“ auf der Startseite wiegt schwer und ist schnell behoben, fehlende Alt-Texte wiegen weniger. Die Wirkung multiplizieren wir mit der Wichtigkeit der betroffenen Seite. Diese messen wir an der internen Verlinkung und künftig, sobald die Search Console angebunden ist, auch an den Klicks. Ein Fehler auf einer viel besuchten Seite rückt so nach oben.
Die zehn höchsten Werte bilden die Aufgabenliste des Monats. Der Vergleich mit dem Vormonat zeigt, welche Befunde behoben und welche neu sind.
Täglicher Schnellcheck
Zwischen den Berichten rufen wir täglich die Startseite und einige Kernseiten ab. Dabei prüfen wir nur wenige kritische Punkte: Erreichbarkeit, Statuscode, noindex, Gültigkeit des SSL-Zertifikats und ob die robots.txt plötzlich alles sperrt. Schlägt einer davon an, geht sofort eine E-Mail raus.
Grenzen
- Wir prüfen nur öffentlich abrufbare Seiten. Bereiche hinter einem Login bleiben außen vor.
- Ohne Search Console können wir Positionen und Klicks nicht messen.
- Der Crawler hält sich an die robots.txt und begrenzt die Abrufe pro Sekunde, damit kleine Server nicht überlastet werden. Sehr große Websites brauchen daher einige Stunden für einen vollständigen Durchlauf.
Wo KI hilft – und wo nicht
Befunde und ihre Reihenfolge entstehen ausschließlich aus festen Regeln. Formuliert eine KI Erklärungen sprachlich um, gleichen wir das Ergebnis stets mit den Befunden ab. Die KI entscheidet nichts.