SovrGPT Dokumentation

KI-Kennzeichnung & Transparenz

KI-Kennzeichnung nach EU AI Act Art. 50 – so markiert SovrGPT erzeugte Bilder, Videos und Audio mit Metadaten, Wasserzeichen und sichtbarem Hinweis.

SovrGPT kennzeichnet erzeugte Bilder, Videos und Audio-Ausgaben als KI-generiert: maschinenlesbar in der Datei und sichtbar im Produkt. Das dient der Transparenzpflicht aus Art. 50 der Verordnung (EU) 2024/1689 (KI-Verordnung, EU AI Act), anwendbar ab 2. August 2026.

Die Kennzeichnung gilt in jedem Tarif und lässt sich nicht abschalten. Sie ist unabhängig vom sichtbaren SovrGPT-Markenhinweis auf Videos, der ab dem Tarif Pro entfällt.

Maschinenlesbar in der Datei (Art. 50 Abs. 2)

Jede erzeugte Datei trägt Metadaten mit dem IPTC-Herkunftswert digitalSourceType = trainedAlgorithmicMedia, auf dem auch C2PA/Content Credentials aufsetzen, und den Klartext-Hinweis Generated by AI - SovrGPT (<modell>).

ModalitätFormatTechnische Umsetzung
BildPNGtEXt-Chunks (Comment, Software, digitalSourceType) + XMP-Paket (Iptc4xmpExt:DigitalSourceType)
VideoMP4Container-Metadaten (comment, digitalSourceType), unabhängig vom sichtbaren Markenhinweis
Audio (TTS / Voice)WAVRIFF-LIST/INFO-Chunk (ICMT-Kommentar + ISFT-Software)
Audio (TTS / Voice)MP3ID3v2.3-Tag (COMM-Kommentar + TXXX digitalSourceType)
Audio (TTS / Voice)FLACVorbis-Comments (COMMENT + DIGITALSOURCETYPE)

Prüfen können Sie das z. B. mit exiftool <datei> oder ffprobe -show_format <datei>. Der KI-Hinweis und der digitalSourceType stehen in der Ausgabe.

Unsichtbare Wasserzeichen

Metadaten lassen sich entfernen. Deshalb tragen viele Ausgaben zusätzlich ein unsichtbares Wasserzeichen im Signal selbst:

  • Bilder: DWT-DCT-SVD-Wasserzeichen in den Pixeldaten. Es übersteht PNG-Neukodierung, JPEG-Kompression (q80) und H.264-Videokompression.
  • Videos: dasselbe Wasserzeichen auf etwa zwei Frames pro Sekunde; es übersteht die H.264-Kodierung.
  • Spezialstimmen (CosyVoice) und geklonte Stimmen: neuronales Perth-Wasserzeichen im Audiosignal, unhörbar und robust gegen Neukodierung.

Sichtbar im Produkt (freiwillig, ergänzend zu Art. 50)

Erzeugte Bilder und Videos tragen im Chat den Hinweis „KI-generiert“, auf dem Medium und darunter. Der Vorlese-Knopf weist die Stimme als KI-generiert aus. Beim Download bleibt die maschinenlesbare Kennzeichnung in der Datei.

Grenzen

  • OGG/Opus: Audio in diesen Formaten trägt derzeit keine eingebettete Kennzeichnung. Wählen Sie WAV, MP3 oder FLAC, wenn Sie sie brauchen.
  • Standardstimme und Katalogstimmen: Sie tragen Metadaten; ein Wasserzeichen im Signal setzen wir dort nicht.
  • Texte: Antworten im Chat und über die API tragen keine eingebettete Kennzeichnung.
  • C2PA: Eine kryptografisch signierte Herkunftskette (C2PA-Signatur) ist geplant, aber noch nicht umgesetzt.

Was das für Sie bedeutet

  • Veröffentlichen: Wer KI-generierte Inhalte veröffentlicht, kann als Betreiber eigene Offenlegungspflichten nach Art. 50 Abs. 4 haben, vor allem bei Deepfakes, also täuschend echten Darstellungen realer Personen. Entfernen Sie die Kennzeichnung nicht.
  • Stimmen klonen: Wer über die API eine Stimme klont, braucht die Einwilligung der Person, der die Stimme gehört. Die erzeugten Clips sind ebenfalls gekennzeichnet.
  • API: Auch Sprachausgaben über die Entwickler-API (/v1/audio/speech) tragen die eingebettete Kennzeichnung, mit denselben Grenzen wie oben.

Verwandte Seiten

KI-Kennzeichnung & Transparenz