Ob ein Bild, ein Video oder eine Tonaufnahme von einer KI stammt, lässt sich mit bloßem Auge immer seltener sagen. Google setzt deshalb auf eine Markierung, die schon beim Erzeugen in die Daten geschrieben wird, und auf ein Werkzeug, das sie wieder ausliest.
Auf diesem Prinzip baut eine Technik auf, die Google seit 2023 unter dem Namen SynthID entwickelt. Der Gedanke dahinter: Statt Medien nachträglich zu bewerten und über ihre Herkunft zu rätseln, wird die Information über ihre Erzeugung direkt in die Daten geschrieben. Ein maschinell erzeugtes Bild trägt dann eine Signatur mit sich, die das Auge nicht wahrnimmt, ein passender Detektor aber auslesen kann. Darum geht es in einer kurzen Ankündigung, die Google am 7. Oktober in seinem Blog veröffentlicht hat.
Pushmeet Kohli, bei Google DeepMind für Wissenschaft und strategische Initiativen verantwortlich, beschreibt darin den nächsten Schritt: Der SynthID Detector, den Google im vergangenen Jahr in einer frühen Version für Medienprofis eingeführt hatte, steht ab sofort weltweit allen offen, zunächst auf Englisch. Wer prüfen will, ob ein Bild, ein Video oder eine Audiodatei von Google oder einem Partnerunternehmen maschinell erzeugt wurde, kann das nun selbst tun. Zu den Partnern zählen OpenAI, NVIDIA und Kakao, Apple soll folgen. Das Werkzeug ergänzt die eingebauten Prüffunktionen in der Suche, in der Gemini-App und in Chrome, die nach Angaben des Unternehmens inzwischen regelmäßig mehr als eine Million Anfragen am Tag bearbeiten.
Was in einem unsichtbaren Wasserzeichen steckt
Die Ankündigung selbst ist kurz: Sie nennt Zahlen, Partner und Verfügbarkeit, sagt aber nichts über Fehlerraten oder darüber, wie gut die Markierung Bearbeitungen übersteht. Die folgende Einordnung beruht deshalb auf den allgemein bekannten Eigenschaften solcher Wasserzeichen, nicht auf neuen Angaben von Google.
Wasserzeichen dieser Art sind keine Etiketten, die man an den Rand einer Datei klebt. Sie stecken tief in den Daten selbst, verteilt über viele Bildpunkte oder über zahlreiche Sekundenbruchteile einer Tonspur. Verändert man einzelne Pixel, soll die Signatur trotzdem lesbar bleiben, weil sie nicht an einer Stelle sitzt, sondern über das Material verteilt ist. Das soll sie gegenüber alltäglichen Bearbeitungsschritten wie leichter Kompression oder Skalierung vergleichsweise robust machen.
Google nennt Zahlen: Mehr als 180 Milliarden Bilder und Videos sollen inzwischen mit einer solchen Signatur versehen worden sein, dazu Audioinhalte von zusammen 240.000 Jahren Laufzeit. In dieser Größenordnung ist das längst kein Forschungsdetail mehr, sondern Teil des normalen Umgangs mit Medien im Netz.
Ein solches Wasserzeichen beantwortet eine Frage: Stammt diese Datei aus einem bestimmten Erzeugungsprozess? Es beantwortet nicht, ob der Inhalt stimmt, ob er fair verwendet wird oder ob er einen Kontext verzerrt. Die Signatur ist ein Herkunftshinweis, kein Qualitätsurteil – und keine Aussage über die Absicht hinter einem Bild.
Wie der SynthID Detector arbeitet
Der Detector funktioniert anders als eine Bildersuchmaschine. Er durchsucht nicht das offene Web, und er rät auch nicht anhand von Stilmerkmalen, ob ein Motiv nach KI aussieht. Stattdessen liest er eine Signatur aus, die Google und seine Partner beim Erzeugen der Inhalte eingebettet haben. Man kann sich das wie ein Prüfgerät vorstellen, das nicht nach verdächtigen Mustern sucht, sondern nach einem bekannten Stempel fragt.
Eine Konsequenz sollte man beim Benutzen im Kopf behalten: Findet das Werkzeug nichts, heißt das nicht automatisch, dass der Inhalt von einem Menschen stammt. Es bedeutet nur, dass keine der gesuchten Signaturen vorhanden ist. Ein mit anderen Werkzeugen erzeugtes Bild kann unauffällig bleiben, obwohl es genauso maschinell entstanden ist. Aus dem Fehlen eines Beweises wird kein Beweis des Gegenteils.
Wer den Detector nutzt, bekommt ein Maß an Sicherheit, keine absolute Gewissheit. Das Ergebnis ist ein Baustein unter mehreren. Der Detector beantwortet eine sehr präzise Frage sehr gut – und lässt offen, was außerhalb dieser Frage liegt.
Wo die Grenzen liegen
Die größte Einschränkung liegt in der Natur der Sache. Ein Wasserzeichen lässt sich, nach allem, was über solche Verfahren bekannt ist, durch starke Bearbeitung entfernen oder so verändern, dass es nicht mehr auslesbar ist. Wer ein Bild neu abfotografiert, mehrfach umkodiert oder aggressiv zuschneidet, kann die Signatur beschädigen. Dann schweigt der Detector, ohne dass damit etwas über die Herkunft gesagt wäre. Das ist kein Konstruktionsfehler, sondern der Preis dafür, dass die Markierung unsichtbar bleibt.
Hinzu kommt die Reichweite der Partnerschaften. Geprüft werden können nur Inhalte, die von Google oder einem der angeschlossenen Anbieter stammen. Ein Bild aus einem Werkzeug, das nicht Teil dieses Netzwerks ist, trägt keine passende Signatur und bleibt für den Detector unsichtbar. Die Abdeckung wächst mit jedem neuen Partner, vollständig wird sie nie. Das Verfahren lebt davon, dass möglichst viele Anbieter mitmachen.
Dass OpenAI, NVIDIA und Kakao dabei sind und Apple folgen soll, ist deshalb wichtig. Ein Herkunftshinweis nützt wenig, wenn er nur innerhalb eines Anbieters funktioniert. Erst wenn mehrere große Player dieselbe Sprache sprechen, wird aus einer Insellösung ein brauchbares Signal. Der Fortschritt liegt also weniger in der Software als in der Bereitschaft, sich auf einen gemeinsamen Standard zu einigen.
Warum die Öffnung für alle zählt
Bislang war der Detector vor allem für Medienprofis gedacht, für Menschen, die beruflich einschätzen müssen, ob Material echt ist. Diese Öffnung verändert die Rolle des Werkzeugs. Aus einem Fachinstrument wird ein alltägliches Prüfmittel, das jeder nutzen kann, ohne die Technik dahinter zu verstehen. Viele KI-Werkzeuge erleichtern bis heute eher das Erzeugen von Inhalten als das Überprüfen.
Wer KI-generierte Inhalte erkennen will, ist auf zugängliche Prüfwege angewiesen. Ein Hinweis, den nur Experten auslesen können, hilft im Alltag kaum. Dass Englisch die erste Sprache ist, ist ein pragmatischer Anfang. Weitere Sprachen dürften folgen. Bis dahin bleibt die Hürde für nicht-englischsprachige Nutzer bestehen, auch wenn die Bedienung simpel ist.
Der Detector ist Teil eines größeren Puzzles. In der Suche, in Gemini und in Chrome gibt es bereits eingebaute Prüffunktionen. Der Detector ist das eigenständige Gegenstück: ein Werkzeug für den Moment, in dem man selbst wissen will, woran man ist.
Was das konkret bedeutet
Für den Alltag heißt das, dass ein Teil der Unsicherheit verschwindet – aber nicht der ganze. Wer ein Bild, ein Video oder eine Audiodatei prüfen will, hat jetzt ein Werkzeug, das eine klare Antwort auf eine klar umrissene Frage gibt. Ein positives Ergebnis liefert einen belastbaren Hinweis auf eine Erzeugung mit Werkzeugen von Google oder seinen Partnern. Ein negatives Ergebnis ist kein Freispruch, sondern nur das Eingeständnis, dass die Suche nichts gefunden hat. Diese Unterscheidung ist entscheidend, wenn man die Ergebnisse nicht überinterpretiert.
Wie viele Anbieter sich dem Netzwerk anschließen und in welchem Tempo, bleibt abzuwarten. Je größer die Abdeckung, desto nützlicher wird das Verfahren. Solange Bearbeitung Signaturen zerstören kann, wird es Lücken geben. Das ist unangenehm, aber ehrlicher als der Eindruck, man könne KI-generierte Medien vollständig identifizieren.
Der Detector verschiebt eine kleine Grenze: von der Vermutung zur Prüfung. Wer wissen will, ob ein Inhalt mit Werkzeugen von Google oder seinen Partnern erzeugt wurde, muss nicht mehr raten, sondern kann nachsehen.
Quelle: blog.google
