Rechtsrahmen
Alles, was die Nutzung von Uttera regelt – Nutzungsbedingungen, Datenschutz, der Auftragsverarbeitungsvertrag und Cookies – lebt auf einer einzigen Seite:
Rechtliche Hinweise und Datenschutz →
Hier steht nur die Zusammenfassung, mit einem Link zu jedem Abschnitt. Der Text, der zählt, ist der auf jener Seite: Zwei Kopien eines Rechtsdokuments driften am Ende auseinander, und dann ist keines etwas wert.
Wofür es NICHT verwendet werden darf
Das ist der Abschnitt, der sich am meisten zu lesen lohnt, bevor Sie integrieren, denn fast alles darin ist eine Straftat und nicht bloß ein Vertragsbruch:
- Sich als eine Person ausgeben mit einer geklonten Stimme, um jemanden zu täuschen.
- Die Stimme einer identifizierbaren Person ohne deren Einwilligung klonen, auch wenn das Ausgangsmaterial öffentlich ist. Die Stimme ist durch Art. 7.6 des spanischen Organgesetzes 1/1982 geschützt.
- Rechtswidrig erlangte Aufnahmen transkribieren. Ein Gespräch aufzunehmen, an dem man beteiligt ist, ist in Spanien keine Straftat; eines zwischen anderen aufzunehmen schon (Art. 197 des Strafgesetzbuchs).
- Personen an ihrer Stimme identifizieren oder ein Register von Stimmabdrücken aufbauen.
- Entscheidungen über Personen treffen aus Ton oder Sprecherprofilierung.
Die vollständige Liste, mit dem jeweils anwendbaren Artikel →
Die KI-Verordnung und das Audio, das Sie erzeugen
Seit dem 2. August 2026 gilt Artikel 50 der Verordnung (EU) 2024/1689. Wenn Sie Audio erzeugen, das eine reale Person imitiert oder das die Öffentlichkeit über Angelegenheiten von öffentlichem Interesse informiert, müssen Sie es offenlegen. Und wenn Ihr System sich mit jemandem unterhält, muss diese Person wissen, dass sie mit einer Maschine spricht.
Die Pflicht, synthetische Inhalte technisch zu kennzeichnen, liegt bei uns, und die Anpassungsfrist, die für uns gilt, endet am 2. Dezember 2026.
Der Zeitplan und die Details →
Das Wasserzeichen
Alles Audio, das Uttera erzeugt, trägt ein Wasserzeichen, seit dem 16. September 2026. Beide Stimmen, Standard und geklont, und alle fünf Formate. Es ist nicht optional, und kein API- Parameter schaltet es ab.
Wir verwenden AudioSeal von Meta, unter der MIT-Lizenz. Es ist eine unmerkliche Markierung, eingebettet in die Klangsamples selbst, kein Metadatenfeld der Datei. Sie wird vor der Kodierung angewandt, sodass sie im Audio, das Sie erhalten, in jedem Format mitreist.
Jede Audioantwort der API trägt den X-Watermark-Header mit dem
verwendeten Schema. Sollten Sie je Audio von uns ohne diesen Header erhalten, ist das ein Fehler auf
unserer Seite, und wir wollen davon erfahren.
Daneben kommen X-Audio-Sha256 und Content-Digest: der SHA-256 der Bytes, die wir Ihnen übergeben, in Hex und in der RFC 9530-Form. Sie beantworten eine andere Frage als die Markierung. Die Markierung sagt, dass das Audio maschinell erzeugt wurde; der Digest sagt, dass die Datei, die Sie in Händen halten, die ist, die hier weggegangen ist. Keines ersetzt das andere, und der Unterschied ist nützlich: Eine Markierung kann eine Neukodierung überstehen, während der Digest aufhört zu passen – wenn also die Markierung da ist und der Digest nicht, ist das, was Sie haben, seit unserem Versand durch irgendetwas gegangen.
Was es sagt, und was es nicht sagt
Die Markierung sagt, dass das Audio maschinell erzeugt wurde. Und sonst nichts: nicht, wer es angefordert hat, noch wann, noch unter welchem Konto, noch irgendeine Kennung, die es auf eine Person zurückführen könnte.
Das AudioSeal-Format trägt 16
Bit Nachricht innerhalb der Markierung, und seit dem 19. September 2026 verwenden wir sie für eine feste Herkunfts-
signatur: 0x5554, die Buchstaben UT in ASCII. Sie ist dieselbe für
jeden Kunden und jede Anfrage.
Sie war aus einem konkreten Grund nötig: AudioSeal ist freie und öffentliche Software, sodass die bloße Anwesenheit einer Markierung nichts darüber aussagt, wessen Audio es ist — jeder, der dasselbe Werkzeug verwendet, erzeugt gleichermaßen gültige Markierungen.
Wofür die Signatur gut ist (und wofür nicht)
Die Signatur beweist nicht, dass ein Stück Audio unseres ist. Weil AudioSeal öffentlich ist, kann jeder eben diese 16 Bit einstempeln. Ihnen etwas anderes zu erzählen, hieße, Ihnen eine Garantie zu verkaufen, die es nicht gibt.
Was sie sehr wohl beweist, ist das Gegenteil, und das ist der Teil, den Sie tatsächlich wollen:
Alles, was unsere Engines erzeugen, ist signiert — es gibt keine Möglichkeit, das abzuschalten, und ein Server
von uns, der nicht markieren könnte, würde nicht starten. Wenn also ein Stück Audio die
UT-Signatur nicht trägt, haben wir es nicht erzeugt. Das ist eine feste Aussage, und Sie können
sie nutzen:
- wenn jemand Uttera eine Aufnahme zuschreibt, die Sie nicht wiedererkennen, schließt die Abwesenheit der Signatur es aus;
- wenn jemand eine geklonte Stimme, die Sie nie angefordert haben, als Ihre ausgibt und behauptet, sie stamme aus unserem System, widerlegt die Abwesenheit der Signatur es.
Sie können das selbst prüfen, ohne uns um irgendetwas zu bitten, mit dem Werkzeug von Meta: Lesen Sie die
Markierung und schauen Sie sich die 16-Bit-Nachricht an. Wenn dort 0x5554 steht, sind das die Buchstaben
UT.
⚠ Die Signatur wird nach Position dekodiert, und komprimierte Formate fügen am
Anfang des Audios eine kleine Verzögerung hinzu. Wenn Sie die Markierung auf einem mp3 lesen, ohne
diesen Versatz zu korrigieren, kommt die Nachricht verändert zurück. Probieren Sie am Anfang ein paar kleine Versätze
aus und behalten Sie die beste Lesung.
Wenn Sie einen positiven Nachweis brauchen, der nicht gefälscht werden kann, ist das Wasserzeichen nicht das richtige Mittel: Verwenden Sie den PDF-Bericht, den wir kryptografisch signieren und der sich unter /verify prüfen lässt.
Wie weit es hält
Von uns gemessen, an Audio, das aus unseren Engines kam:
| Was das Audio durchläuft | Weiterhin erkannt? |
|---|---|
Komprimiert zu mp3, opus oder flac | Ja |
| Dreimal hintereinander neu komprimiert | Ja |
| Festnetz (G.711), ISDN (G.722) | Ja |
| 2G-Mobilfunk (GSM 06.10) | Ja |
| Telefonanlage, die auf 16 kbps komprimiert (G.726) | Ja |
| Auf Telefonband beschnitten (300–3400 Hz) | Ja |
| Über einen Lautsprecher abgespielt und von einem Mikrofon aufgenommen | Ja |
| G.723.1 mit 6,3 kbps (Legacy-VoIP, weitgehend obsolet) | Nein |
Wir veröffentlichen auch den Fall, in dem es scheitert. Eine Markierung, die als unfehlbar dargestellt wird, ist keine Markierung, sie ist Werbung.
Warum wir C2PA NICHT verwenden
C2PA ist ein signiertes Manifest, das innerhalb der Datei mitreist. Es ist der andere gängige Weg, synthetische Inhalte zu kennzeichnen, und wir haben uns entschieden, ihn nicht zu nehmen:
- Ein einziger
ffmpeg-Befehl entfernt es. Es sind Container-Metadaten: Sie gehen bei der Neukodierung verloren, und sie gehen von selbst verloren, sobald das Audio durch irgendeine Plattform läuft, die transkodiert. Es beweist nichts, weil jeder es entfernen kann. - Es ist für die Konformität nicht nötig. Artikel 50 Abs. 2 verlangt maschinenlesbare, erkennbare Kennzeichnung. Das Wasserzeichen ist genau das, in allen fünf Formaten. C2PA ist ein Weg zur Konformität, nicht der Weg.
- Der Standard unterstützt
opusoder rohespcmnicht, zwei der fünf Formate, die wir ausliefern. Von uns gegen die Bibliothek verifiziert, nicht von einer Dokumentationsseite abgelesen. - Es übersteht den Fall nicht, auf den es ankommt. Betrug mit synthetischer Stimme kommt nicht als Datei: Er kommt als Telefonanruf. Dort gibt es keinen Container, keine Metadaten und kein Manifest. Es gibt Audio, und das Wasserzeichen steckt weiterhin darin.
Was C2PA bringt, ist Interoperabilität mit Plattformen, die das Manifest lesen, um Inhalte zu
kennzeichnen. Das ist ein echter Wert, aber er überwiegt das Obige nicht. Wenn sich die Fakten ändern – wenn
der Standard beginnt, opus zu unterstützen, wenn Plattformen beginnen, es zu verlangen – kommen wir
darauf zurück und sagen es hier.
Wenn Sie ein Unternehmen sind, das uns Daten Dritter schickt
Sie sind der Verantwortliche und wir sind der Auftragsverarbeiter (Art. 28 DSGVO). Der Auftragsverarbeitungsvertrag ist schriftlich festgehalten und dient als solcher; wenn Sie einen unterzeichneten Vertrag brauchen, schreiben Sie an support@uttera.ai, und wir unterzeichnen ihn.