Sintetizza la voce
Per la narrazione, invia testo, modello e una voce disponibile per il modello selezionato. Gestisci la risposta come stream audio binario, non come stringa JSON.
Assegna un'estensione di file e un Content-Type in base al formato effettivo della risposta prima di salvare o riprodurre il file.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Trascrizione e input
- Invia un file audio a /audio/transcriptions nel formato documentato.
- Limita la durata e la dimensione del file dal tuo lato, prima che inizi il caricamento.
- Conserva lingua, timestamp e segmenti solo se l'operazione selezionata li restituisce.
Qualità e disponibilità
Voce, formato, lingue e sincronicità dipendono dal modello. Mostra all'utente solo i controlli confermati dal catalogo.
Per i file più lunghi, crea un processo in background nel tuo prodotto, affinché un timeout di rete non definisca il flusso di lavoro dell'utente.