UtteraUttera

Marcar el audio generado ya no es sólo una buena práctica: lo exige el Reglamento europeo

22 de septiembre de 2026

Desde el 2 de agosto de 2026 se aplica el artículo 50 del Reglamento (UE) 2024/1689, el que todo el mundo llama el Reglamento europeo de IA. Dice dos cosas que afectan a cualquiera que genere audio.

La primera es del que usa el sistema: si generas audio que imita a una persona real, o que informa sobre asuntos de interés público, tienes que declararlo. Y si tu sistema conversa con alguien, esa persona tiene que saber que está hablando con una máquina.

La segunda es del que construye el sistema, o sea nuestra: el contenido sintético hay que marcarlo técnicamente, de forma que una máquina pueda detectarlo. Nuestro plazo de adaptación termina el 2 de diciembre de 2026.

Todo el audio que sale de Uttera va marcado desde el 16 de septiembre de 2026. Dos meses y medio antes del plazo, y sin parámetro que lo desactive.

Cómo está hecho

Usamos AudioSeal, de Meta, con licencia MIT. Es una marca imperceptible incrustada en las propias muestras de sonido, no un metadato del fichero: se aplica antes de codificar, así que viaja dentro del audio sea cual sea el formato que pidas, y sobrevive a que lo recomprimas.

Cada respuesta de audio de la API lleva la cabecera X-Watermark con el esquema usado. Si alguna vez recibes audio nuestro sin esa cabecera, es un fallo nuestro y queremos saberlo.

Y aquí está lo que nos parece importante

La marca no dice quién lo generó. AudioSeal es software libre y público: cualquiera que use la misma herramienta produce marcas igual de válidas. Así que la sola presencia de una marca no prueba que un audio sea nuestro, y decir lo contrario sería venderte una garantía que no existe.

Lo que sí probamos es lo contrario, que es lo que de verdad sirve. El formato admite 16 bits de mensaje dentro de la marca, y desde el 19 de septiembre los usamos para una firma fija: 0x5554, que son las letras UT en ASCII. La misma para todos los clientes y todas las peticiones.

Como no hay forma de desactivarla —un servidor nuestro que no supiera marcar no arrancaría—, la conclusión es firme en un solo sentido:

Si un audio no lleva la firma UT, no lo generamos nosotros.

Y eso se usa. Si alguien atribuye a Uttera una grabación que no reconoces, la ausencia de la firma la descarta. Si alguien hace pasar por tuya una voz clonada que no pediste y dice que salió de nuestro sistema, la ausencia de la firma lo desmiente.

Es un escudo, no una medalla. Y preferimos contarlo así a vender la versión bonita.

Compruébalo tú

No hace falta que nos creas ni que te demos ninguna herramienta nuestra. Genera cualquier audio con tu clave, instala la librería de Meta y lee la marca: si el mensaje de 16 bits vale 0x5554, ahí está la firma.

⚠ Un aviso práctico: la firma se decodifica por posición, y los formatos comprimidos añaden un pequeño retardo al principio del audio. Si lees la marca sobre un mp3 sin corregir ese desfase, el mensaje sale cambiado. Hay que probar unos cuantos desplazamientos iniciales y quedarse con la mejor lectura. Sobre el WAV no pasa.

Cuando necesitas una prueba positiva

La marca de agua responde «esto lo hizo una máquina». No responde «esto lo hizo Uttera para ti el martes». Para eso está el informe en PDF, que va firmado criptográficamente y se verifica en uttera.ai/verificar subiendo el fichero: te dice si lo emitimos nosotros y si alguien lo ha tocado desde entonces.

Son dos piezas distintas para dos preguntas distintas, y ninguna sustituye a la otra.

El detalle completo —el calendario del Reglamento, hasta dónde aguanta la marca, y qué información contiene exactamente— está en la documentación.

¿Algo que añadir o que corregir? Escríbenos a support@uttera.ai. Si nos corriges, editamos la entrada y te damos crédito.

← Todas las entradas