Sintetizar voz
Para narração, envie texto, modelo e uma voz disponível para o modelo selecionado. Trate a resposta como fluxo de áudio binário, não como cadeia JSON.
Atribua uma extensão e um Content-Type de acordo com o formato efetivo da resposta antes de guardar ou reproduzir.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Transcrição e entrada
- Envie um ficheiro de áudio para /audio/transcriptions no formato documentado.
- Limite a duração e o tamanho do ficheiro do seu lado antes de iniciar o carregamento.
- Conserve idioma, carimbos de data e hora e segmentos apenas se a operação selecionada os devolver.
Qualidade e disponibilidade
A voz, o formato, os idiomas e a sincronia dependem do modelo. Mostre ao utilizador apenas controlos confirmados pelo catálogo.
Para ficheiros maiores, crie trabalho em segundo plano no seu produto, para que um tempo limite da rede não defina o fluxo do utilizador.