Vorher
from openai import OpenAI
client = OpenAI(
api_key="sk-proj-…"
)Die Audio-API von Uttera spricht dieselbe Sprache wie die von OpenAI. Ändern Sie zwei Zeilen, und Ihr Code funktioniert weiter — mit dem offiziellen SDK, ohne Wrapper und ohne Patches.
Schlüssel holen Die Integration ansehen
Getestet mit dem offiziellen Python-SDK openai · Ohne
einen einzigen Aufruf zu ändern
Das ist buchstäblich alles, was sich ändert.
from openai import OpenAI
client = OpenAI(
api_key="sk-proj-…"
)from openai import OpenAI
client = OpenAI(
api_key="sk-echo-…",
base_url="https://api.uttera.ai/v1"
)Der Rest der Datei bleibt unangetastet.
Mit dem offiziellen SDK geprüft, nicht aus der Dokumentation abgeleitet.
client.audio.speech.create(
model="tts-1",
voice="dora",
input="Hallo.")
Mit tts-1 und tts-1-hd, wie dort. Die Stimmen sind unsere:
GET /v1/audio/voices listet sie.
client.audio.transcriptions.create(
model="whisper-1",
file=f)
Whisper large-v3-turbo darunter. Akzeptiert wav mp3 flac ogg opus aiff m4a
webm.
client.models.list()
Gibt tts-1, tts-1-hd und whisper-1 zurück.
Praktisch, um auf einen Blick zu prüfen, dass Schlüssel und URL stimmen.
Volle Kompatibilität zu versprechen und Sie in Produktion abstürzen zu lassen, wäre schlimmer, als nichts zu versprechen.
chat.completions, embeddings, Bilder und der Rest
geben 404 zurück. Uttera macht Audio: Es ist kein Ersatz für ganz OpenAI, es
ist ein Ersatz für dessen Audio-Teil.
Wenn Ihre Anwendung beide nutzt, behalten Sie den OpenAI-Client für Text und erstellen Sie einen zweiten Client für Audio. Vier Zeilen.
Außerhalb des OpenAI-Formats gibt es Dinge, die es dort nicht gibt: eine Aufnahme mit Stimme in eine andere Sprache übersetzen, eine strukturierte Zusammenfassung, wer wann spricht, Tonfall und Sprecherprofil, Soundeffekte und Musik.
Sie werden auf dieselbe Weise aufgerufen, mit demselben Client und demselben Schlüssel. Sie sind alle hier →
Denn wäre es nur „dasselbe, aber von jemand anderem“, gäbe es keinen Grund.
Das Audio wird auf unserer eigenen Hardware in Spanien verarbeitet. Es gibt keine internationale Übermittlung zu rechtfertigen, keine Standardklauseln und keine Frage, welches Recht Ihre Daten erreicht. Warum das über Käufe entscheidet →
Weder mit Ihren noch mit denen von irgendjemandem. Audio wird verarbeitet und beim Antworten verworfen: Es bleibt keine Kopie, um es zu tun, selbst wenn wir wollten.
Die Engines sind unter offener Lizenz veröffentlicht. Ein Datenschutzversprechen, das Sie nur glauben können, ist weniger wert als eines, das Sie lesen können. Der Code →
Ohne mehr zu installieren, als Sie schon haben.
export UTTERA_API_KEY=sk-echo-…
python3 - <<'PY'
import os
from openai import OpenAI
c = OpenAI(api_key=os.environ["UTTERA_API_KEY"],
base_url="https://api.uttera.ai/v1")
print([m.id for m in c.models.list()])
r = c.audio.speech.create(model="tts-1", voice="dora", input="Es funktioniert.")
open("prueba.mp3", "wb").write(r.content)
PY
Es gibt gleichwertige Beispiele in curl und Node in uttera-examples →
Ein Konto, ein Schlüssel und Credits zum Ausprobieren. Keine Karte.