Ausgaben
Stand September 2026
Dass weit mehr Websites KI-Herkunft in ihren Bilddateien tragen als sichtbar kennzeichnen, ist kein Verstoß an sich. Artikel 50 verlangt die Kennzeichnung nur für Inhalte, die echten Personen, Orten oder Ereignissen täuschend ähnlich sind, nicht für jede KI-Illustration. Die Lücke zeigt, wie viel KI im Netz steckt, nicht wie viel davon kennzeichnungspflichtig wäre. Mehr erfahren
Zeitverlauf
Wer gemessen wird
Wir untersuchen ein festes Panel aus immer denselben 1.449 deutschen Websites. Es umfasst die 1.000 meistbesuchten .de-Domains der Tranco-Liste (bereinigt um Erwachsenenangebote und technische Infrastruktur) sowie alle DAX-Konzerne, Sparkassen, große Klinikträger, Universitätskliniken, führende Wirtschaftskanzleien, Bundesministerien, Bundesbehörden, Landesportale und Städte ab 100.000 Einwohnern.
Nicht im Panel: eigene Projekte von wirklich.ai. Unser Monitor misst die echte Praxis im Land, nicht unseren eigenen Erfolg.
Methodik
- § 1 Messung
- Jede Website läuft einmal im Monat durch den öffentlichen Website-Check von wirklich.ai. Wir prüfen die Startseite und bis zu 19 weitere Unterseiten aus Sitemap und Navigation, maximal 30 Bilddateien je Website sowie robots.txt, Meta-Tags, tdmrep.json, ai.txt, llms.txt und ai-disclosure.json. Die Messung erfolgt seriell mit Pausen zwischen den Aufrufen, bei rund 120 Websites pro Stunde.
- § 2 Sichtbare Kennzeichnung
- Wir zählen ausschließlich Hinweise, die Besucher direkt sehen. Dazu gehören Formulierungen wie „Mit KI erstellt“, „KI-generiert“, „Symbolbild (KI)“ oder „Erstellt mit Midjourney“ in Bildunterschriften und Marken am Bild. Fließtext über das Thema, Fragen und Überschriften zählen nicht. Hinweise im Alt-Text oder Bildtitel weisen wir getrennt aus. Ein automatisches Kennzeichnungs-Script zählt genauso wie ein Hinweis von Hand.
- § 3 Trainings-Signale
- Ein Signal liegt vor, wenn die robots.txt ein Content-Signal oder einen Content-Usage-Eintrag für alle Crawler enthält, ein TDM-Meta-Tag im Seitenkopf steht, eine tdmrep.json oder ai.txt existiert oder mindestens einer von acht bekannten KI-Crawlern ausgesperrt ist. Signale, die erkennbar der Hoster gesetzt hat (etwa Cloudflare), weisen wir separat aus. Getrennt davon zählen wir das Content-Signal ai-input: Damit regelt eine Website, ob KI-Dienste ihre Inhalte live als Quelle für Antworten nutzen dürfen, unabhängig vom Training.
- § 4 KI-Herkunft in Bildern
- Von jeder Bilddatei prüfen wir nur den Dateikopf auf IPTC- und XMP-Angaben (digitalSourceType), C2PA-Manifeste und Spuren bekannter KI-Werkzeuge. Kopiert wird nichts. Da viele Content-Management-Systeme Metadaten beim Upload entfernen, ist dieser Wert eine Untergrenze.
- § 5 Grenzen des Scanners
- Der Scanner erkennt nicht, ob eine Website überhaupt KI-Inhalte nutzt. „Nicht gekennzeichnet“ ist daher kein Fehlverhalten, und wir führen keine Liste von Websites ohne Kennzeichnung. Websites hinter Bot-Schutz (Statuscode 403, 429 oder Zeitüberschreitung) gelten als nicht messbar und fließen nicht in die Quoten ein.
- § 6 Gruppen und Mindestgrößen
- Eine Vergleichsgruppe erscheint ab 20 messbaren Websites. Domains, die zweimal in Folge nicht auflösen, markiert das System als inaktiv; ihre bisherigen Werte bleiben im Zeitverlauf erhalten. Eigene Projekte von wirklich.ai sind vom Panel ausgeschlossen.
- § 7 Ausgaben und Zeitverlauf
- Jede Ausgabe erscheint monatlich und trägt den Namen ihres Messmonats. Der Zeitverlauf fasst alle Monatsdaten zusammen. Veröffentlichte Ausgaben werden eingefroren, ihre Werte verändern sich nachträglich nicht mehr.
- § 8 Daten, Lizenz und Widerspruch
- Jede Ausgabe steht als CSV-Datei unter der Lizenz CC BY 4.0 bereit (Quellenangabe: wirklich.ai, Kennzeichnungs-Monitor). Wer in der Positivliste genannt ist und das nicht möchte, schreibt an monitor@wirklich.ai. Presseanfragen laufen über die Presseseite.