Eine KI kann sehr schnell eine Liste mit Auffälligkeiten liefern. Ob diese Liste stimmt, hängt aber auch davon ab, was das verwendete Werkzeug von der Website tatsächlich gesehen hat.
Der Einwand war berechtigt
Bei einer Websiteprüfung kam die Rückmeldung, dass einige beanstandete Inhalte erst durch JavaScript geladen werden. Die erste Auswertung hatte das Verhalten der Seite nicht vollständig erfasst. Eine fehlende Information in dieser Auswertung war deshalb noch kein Beweis dafür, dass die Information auch für Besucher fehlte.
Wir haben die Seite danach mit einem echten Chromium-Browser geprüft. Dabei wurde nicht nur Text gelesen: Wir haben die Seite geladen, auf nachgeladene Inhalte gewartet, gescrollt, Menüs und Filter bedient und die Formularvalidierung ausprobiert.
Für diesen Erfahrungsbericht ist nicht entscheidend, welche Website betroffen war. Interessant ist der Prüfweg: Ein berechtigter Einwand hat die Untersuchung verbessert. Die ursprüngliche Liste einfach zu verteidigen, hätte niemandem geholfen.
Lesen und Bedienen liefern unterschiedliche Erkenntnisse
Eine Textauswertung kann Links, Überschriften und viele Inhalte erfassen. Je nach Werkzeug bleibt aber offen, ob JavaScript ausgeführt wurde, ob Inhalte erst beim Scrollen erscheinen oder ob eine Aktion einen neuen Zustand auslöst. Deshalb muss ich wissen, was tatsächlich geprüft wurde.
Ein Browser macht das sichtbare Verhalten nachvollziehbar. Öffnet das Menü? Ändert der Terminfilter die Liste? Was passiert bei leeren Pflichtfeldern? Bleibt die Consent-Auswahl erhalten? Solche Fragen lassen sich durch Bedienung gezielter beantworten.
Technische Prüfungen bleiben daneben sinnvoll. Weiterleitungen, HTTP-Status und Sicherheitsheader brauchen eigene Kontrollen. Der sichtbare Eindruck beantwortet nicht jede technische Frage.
Meine Prüfung beginnt mit konkreten Aufgaben
Ich lege vorher fest, was ein Besucher auf der Seite erreichen soll. Daraus werden überprüfbare Schritte. Eine allgemeine Bitte wie „Schau mal, ob alles stimmt“ ist dafür zu ungenau.
- Seite laden: Erscheinen die erwarteten Inhalte nach dem Laden und Scrollen?
- Navigation bedienen: Führen Menüs und Links zum richtigen Ziel?
- Dynamische Inhalte prüfen: Ändern Filter und Auswahlfelder das angezeigte Ergebnis passend?
- Consent prüfen: Lassen sich die angebotenen Optionen wählen und wird die Auswahl beim erneuten Aufruf berücksichtigt?
- Formulare prüfen: Reagieren Pflichtfelder und Hinweise nachvollziehbar? Für den Validierungstest muss keine echte Anfrage abgeschickt werden.
- Schmale Ansicht prüfen: Bleiben Texte, Menüs und Schaltflächen erreichbar und lesbar?
Ein Befund braucht einen nachvollziehbaren Test
Statt nur „Der Filter ist kaputt“ festzuhalten, dokumentiere ich die Seite, die ausgewählte Option, das erwartete Ergebnis und die tatsächliche Reaktion. Dazu gehören Datum, Browser und gegebenenfalls ein Screenshot. So kann jemand anderes den Fehler gezielt nachstellen.
Die Ergebnisse bekommen unterschiedliche Zustände: bestätigt, nach erneuter Prüfung korrigiert oder noch offen. Was ich nicht prüfen konnte, bekommt keinen grünen Haken. Und wenn eine weitere Prüfung einen Befund widerlegt, wird die Aussage berichtigt.
Auch der echte Browser hat Grenzen
Ein erfolgreicher Test in Chromium bestätigt zunächst das Verhalten in der getesteten Umgebung. Andere Browser, Bildschirmgrößen, Konten und Erweiterungen können andere Ergebnisse liefern. Eine schmale Browseransicht hilft bei der ersten Mobilprüfung; ein Test auf einem echten Smartphone kann zusätzliche Probleme zeigen.
Auch ein sichtbares Consent-Fenster beweist allein noch nicht, dass alle Datenschutzanforderungen erfüllt sind. Und eine unauffällige Browseransicht ist kein vollständiger Sicherheitstest. Die Aussage muss zum Umfang der Prüfung passen.
Was KI dabei gut kann und was bei mir bleibt
KI hilft mir, Prüfschritte zu strukturieren, viele Unterseiten systematisch durchzugehen und Ergebnisse verständlich aufzubereiten. Wenn ein geeignetes Browserwerkzeug verfügbar ist, kann sie auch sichtbare Abläufe nachvollziehen. Ich lasse mir aber erklären, welche Schritte wirklich durchgeführt wurden und wo ein Test nicht möglich war.
Ich bestimme den Prüfauftrag und entscheide, welche Folgen ein Ergebnis hat. Besonders bei einer Veröffentlichung oder Abnahme reicht mir keine überzeugend formulierte Zusammenfassung. Ich brauche nachvollziehbare Beobachtungen.
Diese Erfahrung ergänzt meine praktische Arbeitsweise mit KI und den Artikel „ChatGPT war sich sicher – und trotzdem falsch“. Eine gute Zusammenarbeit schließt ein, die erste Antwort noch einmal zu hinterfragen.
Quellen und Stand
Erfahrungsbericht zur Prüfung vom 29.09.2026, Textstand 30.09.2026. Als ergänzende technische Grundlage beschreibt MDN Strategien für Browser- und Gerätetests. Die Erfahrung ersetzt weder eine vollständige Sicherheitsprüfung noch eine rechtliche Bewertung.