UtteraUttera
Uttera — la capa de voz para tu software

Tus grabaciones, convertidas en algo que puedes usar

Transcribe, resume, traduce y pone voz. Por API o desde el navegador, sin instalar nada. Compatible con la API de OpenAI: si ya la usas, cambias dos líneas.

Probar aquí mismo Ver la documentación

Procesado íntegramente en España · No guardamos tus audios · No entrenamos con tus datos · Código abierto

Cumple el RGPD (GDPR) y la LOPDGDD

Lo que sabe hacer

Cinco servicios sobre el mismo audio. Se pagan por segundo, no por petición.

Transcribir

Audio a texto, con el idioma detectado solo.

POST /v1/audio/transcriptions

Poner voz

Texto a audio, con catálogo de voces o con una voz que tú aportas.

POST /v1/audio/speech

Traducir

Una grabación en un idioma, texto y voz en otro.

POST /v1/translate

Analizar

Tono, perfil del hablante y quién habla en cada momento.

?extras=sentiment,profile,diarize

Resumir

Una grabación entera, en un resumen estructurado.

POST /v1/summarize

Y en directo

La voz se entrega mientras se genera: el primer sonido sale al instante.

POST /v1/audio/speech/stream

Y las dos aplicaciones web, para usarlo sin programar nada →

Si ya hablas con OpenAI, ya hablas con nosotros

Mismas rutas, mismos parámetros, mismos nombres de voz. El SDK oficial funciona sin parchear nada: cambias la dirección y la clave.

Y con una diferencia que para muchas empresas es la que decide: el audio no sale de la Unión Europea.

Conectores y ejemplos →

from openai import OpenAI

c = OpenAI(
    api_key="sk-echo-…",
    base_url="https://api.uttera.ai/v1",
)

audio = c.audio.speech.create(
    model="tts-1", voice="nova",
    input="Su pedido sale mañana.",
)

Lo que hacemos con tus datos: procesarlos y devolvértelos

Nada más. Uttera no es un archivo.
La privacidad de tus datos es absoluta.

No guardamos nada

El audio se procesa en memoria y se descarta al responder. La transcripción, el análisis y el resumen viajan en la respuesta y no se almacenan. Lo único que se escribe —el audio que generamos, una hora— lo puedes desactivar tú en cada petición.

Todo en Andalucía

Centros de datos propios en el sur de España. Sin nubes de terceros y sin transferencias internacionales que justificar.

Ni un tercero

Los modelos —incluido el que resume— corren en nuestro hardware. No hay llamadas a OpenAI, ni a Google, ni a nadie.

Ni entrenamos con tus datos, ni los agregamos

Tu audio y tu texto no entrenan ningún modelo. Tampoco se convierten en estadísticas, ni en «datos anonimizados», ni en material de estudio. No hay letra pequeña detrás de esa frase: no queda copia con la que hacerlo. Los modelos no aprenden de lo que pasa por ellos: cada petición empieza y acaba sin dejar rastro. Si algún día entrenamos uno nuestro será con datos licenciados para eso, nunca con los tuyos.

Cómo se justifica, artículo por artículo →

Los motores están publicados

Apache 2.0, y son los mismos que corren en producción. Puedes leer y auditar nuestro código. Si tu caso no admite que el audio salga de tu red, móntalo tú.

Pruébalo sin registrarte

Un minuto de audio o un párrafo de texto. Sin cuenta, sin tarjeta.

0 / 280

La demostración usa la voz estándar y va limitada. Con una cuenta gratuita tienes el catálogo entero, el análisis de voz y los resúmenes.

Empieza gratis

Una cuenta, una clave y créditos para probar. Sin tarjeta y sin pagos.

Crear cuenta Ver el Estudio