Via l'API, ou en connectant ce que vous avez déjà. Il existe du code publié et testé
pour tout ce qui suit.
Support téléphonique
Votre système téléphonique enregistre, Uttera transcrit et résume, et le résultat atterrit là
où travaillent vos équipes. Ce n'est pas de la théorie : il y a deux scripts AGI Asterisk
publiés, un pour parler à l'appelant et un pour l'écouter.
Et la musique d'attente vient aussi d'ici : sur mesure, aussi longue que nécessaire,
sans licence annuelle derrière.
Comment un système téléphonique se connecte →
Ventes et CRM
Chaque appel laisse une note écrite avec les engagements et les prochaines étapes, au lieu de
dépendre de quelqu'un qui pense à l'écrire. Le résumé arrive structuré, pour se mapper sur des champs.
Qualité et formation
Sur un échantillon d'appels : ce qui a été dit, qui a parlé combien de temps, et sur quel ton.
Pour trouver où le script se coince et ce qu'il faut enseigner.
Avec une limite que nous nous imposons : le ton et le profil du
locuteur sont des estimations acoustiques, elles se trompent, et elles ne doivent pas servir à
prendre des décisions sur une personne — ni pour l'embauche, ni pour noter qui que ce soit.
Elles existent pour améliorer des processus, pas pour juger des personnes.
Vendre à l'étranger
Formations, annonces, support enregistré : faits une fois dans une langue, puis traduits et
interprétés dans les autres. Sans réengager le comédien voix à chaque fois qu'une phrase change.
Automatiser sans code
Si vous utilisez déjà n8n, il y a un nœud et des workflows prêts à importer : un dossier
d'enregistrements en entrée, un résumé par e-mail ou chat en sortie.
Le code, sur GitHub →
Jeux et applications
Ici le son n'est pas de la post-production, c'est une partie du produit : effets et
musique sont demandés via l'API pendant que l'application tourne, avec une description et une durée.
Et ce que vous générez est à vous, il n'y a donc aucune licence à revoir pour chaque morceau
avant de publier une version.
L'accessibilité, désormais une obligation légale
Depuis le 28 juin 2025, la loi 11/2023 espagnole —transposant l'European Accessibility
Act— impose sous-titres et audiodescription sur les contenus audiovisuels que vous publiez, et
elle atteint l'e-commerce, la banque, les transports et les télécoms.
Les sous-titres viennent de la transcription et l'audiodescription de la synthèse vocale :
exactement le travail que cela fait déjà. Se mettre en conformité cesse d'être un projet et
devient une case à cocher.
Marketing et contenu de marque
Une campagne, ce sont beaucoup de petits morceaux : le spot radio, la vidéo produit, le
message sur le stand, et tous à nouveau en quatre langues.
Voix, musique et effets viennent du même endroit et avec une licence commerciale. Aucune
licence stock à acheter par morceau, et pas besoin de retourner au studio parce que quelqu'un a
changé une ligne la veille.
Agents IA
Nous sommes compatibles OpenAI : si votre agent lui parle déjà, vous changez l'URL de base et
il peut entendre et parler. Il y a aussi une skill conçue pour les agents.
Et si vous construisez de l'IA pour gagner votre vie, cela vient avant le produit :
parler à votre propre agent au lieu de taper au clavier, et entendre ce qu'il répond pendant que
vous regardez autre chose. La même clé couvre les deux.
Et un que presque personne ne voit : payer moins votre LLM
Si un modèle de langage d'un autre fournisseur doit raisonner sur un appel, la voie chère est
de lui envoyer toute la transcription. La voie bon marché est de lui envoyer le résumé.
Mesuré sur un enregistrement réel de 70 minutes : 15 410 tokens de transcription contre
moins de 700 de résumé. Vingt à trente fois moins. Et en plus, l'enregistrement ne quitte
jamais ici.
Les chiffres, et quand ça ne vaut PAS le coup →
Ce que coûte le démarrage
Un compte gratuit avec des crédits pour l'essayer, sans carte et sans paiement. Ce qui est
facturé l'est par seconde d'audio, pas par requête, et la réponse porte dans un en-tête
exactement ce qui a été facturé.
Voir les plans →