UtteraUttera

Wofür Uttera wirklich genutzt wird

Was folgt, ist keine Liste von Branchen, erfunden, um eine Seite zu füllen: Es ist die Art, wie ein System, das transkribiert, zusammenfasst, übersetzt und sprechen lässt, genutzt wird. Wo die Datensouveränität das ist, was den Kauf entscheidet, sagen wir es an Ort und Stelle und erklären warum.

Ohne Anmeldung ausprobieren Doku lesen

Wenn Sie auf eigene Rechnung arbeiten

Ein Konto, ein Schlüssel und die Studio-Seite. Nichts zu programmieren.

Klinisches Diktat

Ärzte, Psychologen, Physiotherapeuten und Tierärzte, die ihre Notizen nach jedem Patienten diktieren und den Text wollen, nicht das Audio. Auf einem Telefon aufnehmen, ins Studio ziehen, die Transkription zurückbekommen.

Hier ist Souveränität kein Extra. Eine klinische Aufnahme ist ein Gesundheitsdatum — eine besondere Kategorie nach der DSGVO — und sie durch einen Dienst laufen zu lassen, der sie speichert, wiederverwendet oder außerhalb der EU verarbeitet, ist ein Problem, das ein generisches Einwilligungsformular nicht löst. Hier verlässt sie niemals Spanien und wird nicht gespeichert.

Kanzleien und Berater

Mandantengespräche, Anrufe, Notizen aus einer Verhandlung. Die Aufnahme geht hinein, und heraus kommen die Transkription und eine Zusammenfassung des Vereinbarten, fertig, um in die Akte eingefügt zu werden.

Die Verschwiegenheitspflicht unterscheidet nicht zwischen einem Aktenschrank und einem Server. Das Audio beim Antworten zu verwerfen ist keine Vorliebe mehr, sondern Teil davon, wie die Pflicht erfüllt wird.

Podcasts und Video

Eine Folge ergibt die Transkription zum Veröffentlichen, die Kapitel, die Untertitel und — wenn Sie möchten — dieselbe Folge übersetzt und vertont in einer anderen Sprache.

Eine geklonte Stimme geht von einer eigenen Probe aus: Um sich in eine Sprache zu synchronisieren, die Sie nicht sprechen, muss die Stimme nicht aufhören, Ihre zu sein.

Und was fehlt, wenn die Stimme fertig ist: Soundeffekte und Musik, in Worten beschrieben und auf der Stelle erzeugt. Die Titelmelodie, der Schlag, der zwei Abschnitte trennt, der Hintergrund einer Szene — mit kommerzieller Lizenz ab dem Startup-Plan und ohne Katalog zum Durchwühlen.

Barrierefreiheit

Lesen Sie ein langes Dokument laut vor, um es beim Fahren zu hören, oder untertiteln Sie ein Video, das keine hat. Neun Sprachen in der Standardstimme und rund dreißig in der hochwertigen.

Lernen und Mitschreiben

Eine aufgezeichnete zweistündige Vorlesung wird in unter einer Minute transkribiert und zu einer Gliederung zusammengefasst. Was früher drei Stunden Nacharbeit waren, sind zehn Minuten Lesen.

Aussprache lernen

Schreiben Sie den Satz, den Sie morgen sagen müssen, und hören Sie ihn in der Sprache, die Sie lernen, in der Geschwindigkeit, die Sie brauchen. Dann sagen Sie ihn selbst und prüfen, ob wir Sie verstanden haben.

Wie es funktioniert, und was es nicht tut →

Ihr Video in Ihrer eigenen Stimme synchronisieren

Nehmen Sie einmal in Ihrer Sprache auf und veröffentlichen Sie es in einer anderen, in Ihrer eigenen Stimme gesprochen, nicht in einer Katalogstimme, die nicht Ihre ist. Laden Sie die Aufnahme hoch, wählen Sie die Ausgabesprache und setzen Sie das Häkchen, das die Originalstimme bewahrt.

Das ist der Unterschied zwischen ein Video zu übersetzen und es zu synchronisieren: Ihr Publikum erkennt Sie weiterhin.

Hören, was Sie geschrieben haben

Jeder, der schreibt, weiß, dass holprige Sätze gehört werden, bevor man sie sieht. Fügen Sie den Text ein, hören Sie ihn, und die Stolperer zeigen sich von selbst: der Satzteil, der nie Luft holt, das Wort, das drei Zeilen später wiederholt wird.

Es funktioniert gleich für ein Skript, einen schwierigen Brief oder die E-Mail, bei der Sie nicht sicher sind, ob sie zu schroff geraten ist.

Interviews

Journalismus, qualitative Forschung, Oral History. Transkription mit Sprechertrennung, damit Sie wissen, wer was gesagt hat, ohne das ganze Band erneut zu hören.

Wenn Sie ein Unternehmen führen

Über die API oder indem Sie verbinden, was Sie schon haben. Für alles Folgende gibt es veröffentlichten, getesteten Code.

Telefon-Support

Ihre Telefonanlage nimmt auf, Uttera transkribiert und fasst zusammen, und das Ergebnis landet dort, wo Ihre Leute arbeiten. Das ist keine Theorie: Es sind zwei Asterisk-AGI-Skripte veröffentlicht, eines, um mit dem Anrufer zu sprechen, und eines, um ihm zuzuhören.

Und die Warteschleifenmusik kommt auch von hier: nach Maß, so lang Sie brauchen, ohne Jahreslizenz dahinter.

Wie sich eine Telefonanlage verbindet →

Vertrieb und CRM

Jeder Anruf hinterlässt eine schriftliche Notiz mit den Zusagen und den nächsten Schritten, statt davon abzuhängen, dass jemand daran denkt, sie zu schreiben. Die Zusammenfassung kommt strukturiert, sodass sie auf Felder abbildbar ist.

Qualität und Schulung

Über eine Stichprobe von Anrufen: was gesagt wurde, wer wie lange sprach und in welchem Ton. Um zu finden, wo das Skript hakt und was gelehrt werden muss.

Mit einer Grenze, die wir uns selbst setzen: Ton und Sprecherprofil sind akustische Schätzungen, sie liegen falsch, und sie dürfen nicht verwendet werden, um Entscheidungen über eine Person zu treffen — nicht zur Einstellung, nicht zur Bewertung von irgendjemandem. Sie existieren, um Prozesse zu verbessern, nicht um Menschen zu beurteilen.

Im Ausland verkaufen

Schulungen, Ankündigungen, aufgezeichneter Support: einmal in einer Sprache erstellt, dann in die übrigen übersetzt und vertont. Ohne den Sprecher jedes Mal neu zu buchen, wenn sich ein Satz ändert.

Ohne Code automatisieren

Wenn Sie bereits n8n nutzen, gibt es einen Node und fertige Workflows zum Importieren: ein Ordner mit Aufnahmen hinein, eine Zusammenfassung per E-Mail oder Chat hinaus.

Der Code, auf GitHub →

Spiele und Anwendungen

Hier ist Klang keine Postproduktion, er ist Teil des Produkts: Effekte und Musik werden über die API angefordert, während die Anwendung läuft, mit einer Beschreibung und einer Länge.

Und was Sie erzeugen, gehört Ihnen, es gibt also keine Lizenz zu prüfen für jedes Stück, bevor Sie ein Release veröffentlichen.

Barrierefreiheit, jetzt eine gesetzliche Pflicht

Seit dem 28. Juni 2025 verlangt das spanische Gesetz 11/2023 —Umsetzung des European Accessibility Act— Untertitel und Audiodeskription für die audiovisuellen Inhalte, die Sie veröffentlichen, und es erreicht E-Commerce, Banken, Verkehr und Telekommunikation.

Untertitel kommen aus der Transkription und Audiodeskription aus synthetischer Sprache: genau die Arbeit, die dies bereits leistet. Konformität hört auf, ein Projekt zu sein, und wird ein Häkchen.

Marketing und Markeninhalte

Eine Kampagne besteht aus vielen kleinen Teilen: der Radiospot, das Produktvideo, die Botschaft am Stand, und alle noch einmal in vier Sprachen.

Stimme, Musik und Effekte kommen vom selben Ort und mit kommerzieller Lizenz. Keine Stock-Lizenz pro Stück zu kaufen, und kein Zurück ins Studio, weil jemand am Vortag eine Zeile geändert hat.

KI-Agenten

Wir sind OpenAI-kompatibel: Wenn Ihr Agent schon mit ihm spricht, ändern Sie die Basis-URL, und er kann hören und sprechen. Es gibt auch eine Skill, die für Agenten gebaut ist.

Und wenn Sie KI beruflich bauen, kommt das vor dem Produkt: mit Ihrem eigenen Agenten zu sprechen, statt ihn abzutippen, und zu hören, was er antwortet, während Sie etwas anderes ansehen. Derselbe Schlüssel deckt beides ab.

Und einer, den fast niemand sieht: Ihr LLM weniger bezahlen

Wenn ein Sprachmodell eines anderen Anbieters über einen Anruf nachdenken muss, ist der teure Weg, ihm die ganze Transkription zu schicken. Der günstige ist, ihm die Zusammenfassung zu schicken.

Gemessen an einer echten 70-minütigen Aufnahme: 15.410 Tokens Transkript gegen unter 700 Zusammenfassung. Zwanzig- bis dreißigmal weniger. Und obendrein verlässt die Aufnahme niemals diesen Ort.

Die Zahlen, und wann es sich NICHT lohnt →

Was der Start kostet

Ein kostenloses Konto mit Credits zum Ausprobieren, ohne Karte und ohne Zahlungen. Was berechnet wird, wird pro Sekunde Audio berechnet, nicht pro Anfrage, und die Antwort trägt in einem Header genau das, was berechnet wurde.

Die Pläne ansehen →

Wenn Sie eine öffentliche Stelle sind

Hier ist die Frage meist nicht, was es kann, sondern wo es verarbeitet wird und was aufbewahrt wird.

Ratssitzungen und Protokolle

Eine dreistündige Ratssitzung wird mit Sprechertrennung transkribiert und nach Tagesordnungspunkt zusammengefasst. Das Protokoll zu schreiben hört auf, die Arbeit eines Nachmittags zu sein.

Das Video der Sitzung ist öffentlich, aber der Protokollentwurf ist es nicht: Ihn in der Cloud eines anderen zu verarbeiten verwandelt einen internen Schritt in eine Offenlegung personenbezogener Daten.

Gerichte

Verhandlungen, Aussagen und Erscheinen, transkribiert mit wer in jedem Moment spricht. Einen Satz in neun Stunden Aufnahme zu finden hört auf, die Arbeit eines Praktikanten zu sein.

Gesundheitswesen

Klinisches Diktat und Berichte. Bei Gesundheitsdaten ist die Entscheidung keine der Bequemlichkeit: Es ist eine besondere Kategorie nach der DSGVO, und wo verarbeitet wird, ist Teil der Risikobewertung.

Uttera transkribiert und fasst zusammen; es ist kein Medizinprodukt und entscheidet nichts Klinisches. Was es erzeugt, ist Text, den eine Fachkraft prüft.

Bildung

Aufgezeichnete Unterrichtsstunden, verwandelt in Notizen und Untertitel, in mehreren Sprachen. Barrierefreiheit für die, die schlecht hören, und Wiederholungsmaterial für alle, aus derselben Arbeit.

Archive und Kulturerbe

Audio-Sammlungen — Oral History, Radio, Tonarchive — die heute nicht konsultiert werden können, weil sie nicht verschriftlicht sind. Sie zu transkribieren macht sie durchsuchbar.

Forschung

Interviews und Fokusgruppen, transkribiert und nach Sprecher getrennt. Ethikkommissionen fragen fast immer dieselben zwei Dinge: wo verarbeitet wird und was aufbewahrt wird. Beide Antworten sind aufgeschrieben.

Warum die Datensouveränität so viele dieser Käufe entscheidet

Es ist kein Marketing-Etikett: Es ist das, was eine Vergabeakte bestehen oder scheitern lässt.

Kein Transfer zu rechtfertigen

Wenn ein Anbieter personenbezogene Daten außerhalb des Europäischen Wirtschaftsraums verarbeitet, braucht dieser Transfer seine eigene Rechtsgrundlage: Standardvertragsklauseln, eine Folgenabschätzung und die Unsicherheit, die sie seit dem Fall des Privacy Shield tragen. Hier existiert dieses Problem nicht, weil keine Daten hinausgehen.

Zweckbindung, wirklich

Artikel 5 Absatz 1 Buchstabe b der DSGVO verlangt, dass Daten nur für das verarbeitet werden, wofür sie erhoben wurden. Die übliche Formel der Branche — „wir nutzen Ihre personenbezogenen Daten nicht“, und darunter die Erlaubnis, sie aggregiert oder „anonymisiert“ zu nutzen — ist hier nicht: keine Kopie überlebt, um es zu tun.

Wir trainieren nicht mit Ihren Daten, und wir aggregieren sie nicht

Ihr Audio und Ihr Text trainieren kein Modell, weder unseres noch das eines anderen, und werden nicht zu Statistiken oder Studienmaterial. Audio wird im Arbeitsspeicher verarbeitet und beim Antworten verworfen.

Und es lässt sich prüfen

Die Engines, die die Arbeit tun, sind unter offener Lizenz veröffentlicht. Ein Datenschutzversprechen, das Sie nur glauben können, ist weniger wert als eines, das Sie lesen können.

Welches Recht Ihre Daten erreicht, entscheidet nicht der Server

Ein Anbieter unter US-Gerichtsbarkeit kann nach dem CLOUD Act gezwungen werden, Daten herauszugeben, selbst wenn die Maschine in Frankfurt steht: Was entscheidet, ist nicht, wo der Server steht, sondern wessen Unternehmen ihn betreibt.

Deshalb klärt „Server in der EU“ die Frage nicht. Hier ist das Unternehmen spanisch und die Maschine auch.

Und wenn wir verschwinden, stehen Sie nicht im Regen

Das Risiko, das in einer Vergabeakte am schwersten wiegt, ist nicht, dass der Anbieter einen schlechten Dienstag hat: Es ist, dass er schließt. Die Engines sind unter offener Lizenz veröffentlicht, sodass das, was heute hier läuft, morgen auf Ihrem eigenen Server aufgesetzt werden kann.

Von uns abzuhängen ist eine Entscheidung, die Sie revidieren können, keine Tür, die sich schließt, wenn Sie unterschreiben.

Wie es standhält, Artikel für Artikel →

Ihr Fall ist hier nicht dabei?

Wahrscheinlich passt er trotzdem: Darunter ist all das dieselben Dienste auf einer Audiodatei. Schreiben Sie an support@uttera.ai, und wir sehen es uns an — und wenn es nicht passt, sagen wir auch das.

Kostenloses Konto erstellen Doku lesen

Vollständig in Spanien verarbeitet · Wir speichern Ihr Audio nicht · Wir trainieren nicht mit Ihren Daten · Open Source

Konform mit der DSGVO und dem spanischen LOPDGDD