404-Fehler: Der Konstruktionsfehler, den Du reparieren kannst

Fünf Fragen an Deine Website

Bevor es losgeht, ein kurzer Selbsttest. Beantworte die folgenden Fragen ehrlich:

  1. Weißt Du, wie viele Aufrufe Deiner Website im letzten Monat mit einem 404-Fehler geendet haben?
  2. Hast Du beim letzten Relaunch eine Liste mit alten und neuen URLs angelegt?
  3. Führen alle Links in Deinen Anzeigen, Newslettern und QR-Codes noch auf eine existierende Seite?
  4. Weißt Du, wie viele Kilobyte Deine 404-Seite überträgt?
  5. Hast Du schon einmal geprüft, ob KI-Assistenten Besucher auf Seiten schicken, die es bei Dir nie gab?

Wenn Du zweimal oder öfter mit Nein antwortest, lohnt sich dieser Artikel für Dich.

Ein Konstruktionsfehler des Webs

Kaputte Links sind kein Versehen einzelner Betreiber, sie stecken im Bauplan des Webs. Ein Link zeigt nur in eine Richtung. Die Zielseite weiß nicht, wer auf sie verweist, und kann niemandem Bescheid geben, wenn sie umzieht. Ted Nelson hatte für sein Hypertext-Projekt Xanadu Links in beide Richtungen vorgesehen. Durchgesetzt hat sich das einfachere Web, und mit ihm der Link-Verfall.

Tim Berners-Lee hat schon 1998 geschrieben, dass gute URLs sich nicht ändern. Geändert werden sie trotzdem, von Menschen: bei jedem Relaunch, jeder neuen Seitenstruktur, jedem Wechsel des CMS. Wie groß die Folgen sind, hat das Pew Research Center gemessen: 38 Prozent der Webseiten, die 2013 existierten, waren zehn Jahre später nicht mehr erreichbar.

Ich erlebe das selbst. Bei analytik.news prüfen wir regelmäßig alle Links auf defekte Ziele, und jeder Testlauf findet neue. Besonders ärgerlich sind Links, die man selbst nach außen gegeben hat: in Werbeanzeigen, Pressemitteilungen, Newslettern oder auf gedruckten QR-Codes. Die lassen sich nachträglich nicht mehr korrigieren.

Eine wirklich funktionierende Lösung gibt es bisher nur in der Wissenschaft. Das DOI-System gibt Fachartikeln eine dauerhafte Kennung, die unabhängig von ihrer aktuellen Adresse ist. Zieht ein Artikel um, wird nur die Zuordnung im Hintergrund aktualisiert. Für normale Websites gibt es nichts Vergleichbares. Du musst selbst aufpassen.

Wer unter einem 404 leidet

Für Menschen ist ein 404 eine Sackgasse. Sie verlieren Vertrauen und klicken weg, oft direkt zur Konkurrenz.

Für Suchmaschinen ist ein echter 404 zunächst ein klares Signal. Google schreibt selbst, dass dieser Statuscode ein starkes Zeichen ist, die URL nicht erneut abzurufen. Problematisch sind sogenannte Soft 404s: Seiten, die „nicht gefunden“ anzeigen, technisch aber „alles in Ordnung“ melden. Die crawlt Google laut eigener Dokumentation weiter und verschwendet damit Crawl-Budget. Interne Links auf tote Seiten schicken Crawler zudem immer wieder ins Leere.

Neu hinzugekommen sind KI-Assistenten. Sie erfinden URLs, die plausibel klingen, aber nie existiert haben. Eine Auswertung von Ahrefs kommt zu dem Ergebnis, dass KI-Assistenten Besucher fast dreimal so oft auf 404-Seiten schicken wie die Google-Suche. Ahrefs verkauft SEO-Werkzeuge und hat ein Interesse an diesem Befund. Die Richtung ist trotzdem plausibel, denn ein Sprachmodell rät Adressen, statt sie nachzuschlagen.

Und dann ist da noch die Umwelt. Jeder Fehlaufruf erzeugt Serverlast und Datenübertragung, ohne dass irgendjemand etwas davon hat. Bei vielen Websites ist die 404-Seite eine vollwertige Seite mit Bildern, Schriften und Tracking. Bei einem CMS wie WordPress durchläuft zudem jeder 404 die komplette Anwendung samt Datenbankabfragen. Ein Fehler kostet dann so viel wie ein echter Seitenaufruf.

Achtung
Nicht jeder 404 ist Dein Fehler. Bots tasten Websites ständig nach bekannten Schwachstellen ab und fragen Adressen wie /wp-login.php oder /.env ab, auch wenn es sie bei Dir gar nicht gibt. Diese Anfragen musst Du nicht reparieren. Filtere sie bei der Auswertung heraus, sonst erschrickst Du über Zahlen, die mit Deinen Inhalten nichts zu tun haben.

So findest Du Deine 404-Fehler

Es gibt drei Wege, je nachdem, wie tief Du einsteigen willst:

  • Google Search Console: kostenlos und schnell eingerichtet. Du siehst, welche URLs Google nicht findet, inklusive Soft 404s. Allerdings nur aus Sicht von Google.
  • Crawler wie Screaming Frog: Sie folgen allen Links auf Deiner Website und zeigen, wo interne Links ins Leere führen. Tote Links, die von außen auf Dich zeigen, findest Du damit nicht.
  • Logfile-Auswertung: Das Server-Logfile verzeichnet jede Anfrage, von Menschen, Suchmaschinen und KI-Agenten. Nur hier siehst Du alle 404-Fehler, auch fehlende Favicons, Bilder oder Skripte, und woher die Aufrufe kamen. Das ist der aufwendigste Weg, aber der einzig vollständige.

So reparierst Du sie

Hat eine Seite einen Nachfolger, leite die alte Adresse dauerhaft per 301-Weiterleitung dorthin um. Und zwar direkt, ohne Zwischenstationen, denn Weiterleitungsketten kosten bei jedem Aufruf zusätzliche Anfragen. Ist ein Inhalt bewusst gelöscht, ist der Status 410 ehrlicher als 404, denn er bedeutet „dauerhaft entfernt“. Interne Links korrigierst Du direkt im Text, statt sie nur umzuleiten.

Taucht eine erfundene KI-URL häufig in Deinen Logs auf, leite sie auf die Seite um, die der Besucher vermutlich gesucht hat. Und mach Deine 404-Seite schlank: ein kurzer Hinweis, ein Suchfeld, ein Link zur Startseite. Mehr braucht es nicht.

Tipp
Damit es gar nicht erst so weit kommt: Lege vor jedem Relaunch eine Tabelle mit alten und neuen URLs an. Und gib in Anzeigen, Drucksachen und QR-Codes nur kurze Adressen heraus, die Du selbst kontrollierst, etwa /go/messe2026. Die leitest Du weiter und kannst das Ziel jederzeit ändern, ohne dass der gedruckte Link kaputtgeht.

Fang mit dem Logfile an

Wenn Du beim Selbsttest mehrmals mit Nein geantwortet hast, ist das kein Grund zur Panik, aber ein guter Anlass für eine Stunde mit Deinem Logfile. Wenn Du dabei Unterstützung möchtest, werte ich es gern mit Dir aus, und wir erstellen gemeinsam eine priorisierte Liste mit Weiterleitungen. Vereinbare dazu einfach einen Termin.

Jeder tote Link ist ein Versprechen, das Deine Website nicht hält.

Quellen: