Transcrire
De l'audio au texte, avec la langue détectée toute seule.
POST /v1/audio/transcriptions
Transcrivez, résumez, traduisez et faites parler. Analysez votre prononciation, ou créez des effets sonores et de la musique originale. Via une API ou depuis votre navigateur, sans rien installer. Compatible OpenAI : si vous l'utilisez déjà, vous changez deux lignes.
Essayez-le ici même Lire la documentation
Traité entièrement en Espagne · Nous ne conservons pas votre audio · Nous n'entraînons rien sur vos données · Open source
Conforme au RGPD et à la LOPDGDD espagnole
Les services, sur l'audio que vous avez ou en générant l'audio que vous n'avez pas. Facturé à la seconde, pas à la requête.
De l'audio au texte, avec la langue détectée toute seule.
POST /v1/audio/transcriptionsDu texte à l'audio, depuis un catalogue de voix ou une voix que vous fournissez.
POST /v1/audio/speechUn enregistrement dans une langue ; le texte et la voix dans une autre.
POST /v1/translateLe ton, le profil du locuteur, et qui parle à chaque instant.
?extras=sentiment,profile,diarizeTout un enregistrement, sous forme de résumé structuré.
POST /v1/summarizeVous lisez une phrase et nous vous disons ce que vous avez ajouté, omis et dans quel mot.
POST /v1/pronunciationDécrivez-le avec des mots et le son sort. Ou une scène entière, avec ses couches.
POST /v1/audio/sfxDe la musique originale à partir d'une description, jusqu'à six minutes.
POST /v1/audio/musicLa voix est livrée à mesure qu'elle est générée : le premier son sort immédiatement.
POST /v1/audio/speech/streamEt les applications web, pour l'utiliser sans écrire une ligne de code →
Mêmes routes, mêmes paramètres, mêmes noms de voix. Le SDK officiel fonctionne sans rien modifier : vous changez l'adresse et la clé.
Avec une différence qui fait pencher la balance pour bien des entreprises : l'audio ne quitte jamais l'Union européenne.
from openai import OpenAI
c = OpenAI(
api_key="sk-echo-…",
base_url="https://api.uttera.ai/v1",
)
audio = c.audio.speech.create(
model="tts-1", voice="nova",
input="Votre commande part demain.",
)
Rien d'autre. Uttera n'est pas une archive.
Vos données restent les vôtres, sans exception.
L'audio est traité en mémoire et jeté dès que nous répondons. La transcription, l'analyse et le résumé voyagent dans la réponse et ne sont pas stockés. La seule chose écrite sur disque — l'audio que nous générons, pendant une heure — vous pouvez la désactiver vous-même à chaque requête.
Nos propres centres de données dans le sud de l'Espagne. Aucun cloud tiers et aucun transfert international à justifier.
Les modèles — y compris celui qui résume — tournent sur notre propre matériel. Il n'y a aucun appel à OpenAI, ni à Google, ni à personne.
Votre audio et votre texte n'entraînent aucun modèle. Ils ne deviennent pas non plus des statistiques, ni des « données anonymisées », ni du matériel d'étude. Il n'y a aucune clause en petits caractères derrière cette phrase : aucune copie ne survit pour le faire. Les modèles n'apprennent rien de ce qui les traverse : chaque requête commence et se termine sans laisser de trace. Si un jour nous entraînons l'un des nôtres, ce sera sur des données licenciées pour cela, jamais sur les vôtres.
Apache 2.0, et ce sont les mêmes qui tournent en production. Vous pouvez lire et auditer notre code. Si votre cas ne permet pas que l'audio quitte votre réseau, faites-le tourner vous-même.
Une minute d'audio ou un paragraphe de texte. Sans compte, sans carte.
La démo utilise la voix standard et est limitée en débit. Un compte gratuit vous donne accès à tout le catalogue, à l'analyse de voix et aux résumés.
Un compte, une clé et des crédits pour l'essayer. Sans carte et sans paiement.
Créer un compte Voir le Studio
Vous travaillez avec un agent IA ? Dites-lui ceci et il se configure tout seul :
read https://uttera.ai/skill.md and follow the instructions