Sprache synthetisieren
Senden Sie für eine Sprachausgabe Text, Modell und eine für das ausgewählte Modell verfügbare Stimme. Verarbeiten Sie die Antwort als binären Audiostream, nicht als JSON-Zeichenfolge.
Legen Sie Dateierweiterung und Content-Type vor dem Speichern oder Abspielen anhand des tatsächlichen Antwortformats fest.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Transkription und Eingabe
- Senden Sie eine Audiodatei im dokumentierten Format an /audio/transcriptions.
- Begrenzen Sie Dauer und Größe der Datei auf Ihrer Seite, bevor der Upload beginnt.
- Bewahren Sie Sprache, Zeitstempel und Segmente nur auf, wenn der ausgewählte Vorgang sie zurückgibt.
Qualität und Verfügbarkeit
Stimme, Format, Sprachen und Synchronität hängen vom Modell ab. Zeigen Sie einem Benutzer nur Steuerelemente, die der Katalog bestätigt.
Erstellen Sie für längere Dateien Hintergrundarbeit in Ihrem Produkt, damit ein Netzwerk-Timeout nicht den Arbeitsablauf des Benutzers bestimmt.