cicora.ai
Especificação da APIVoz

Áudio

Use operações separadas para síntese de voz, transcrição e entrada de áudio num modelo.

Referência de integração: escolha os parâmetros e as capacidades disponíveis nas definições da API da sua conta e no catálogo de modelos do seu ambiente.

Sintetizar voz

Para narração, envie texto, modelo e uma voz disponível para o modelo selecionado. Trate a resposta como fluxo de áudio binário, não como cadeia JSON.

Atribua uma extensão e um Content-Type de acordo com o formato efetivo da resposta antes de guardar ou reproduzir.

Pedido de conversão de texto em voz
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transcrição e entrada

  • Envie um ficheiro de áudio para /audio/transcriptions no formato documentado.
  • Limite a duração e o tamanho do ficheiro do seu lado antes de iniciar o carregamento.
  • Conserve idioma, carimbos de data e hora e segmentos apenas se a operação selecionada os devolver.

Qualidade e disponibilidade

A voz, o formato, os idiomas e a sincronia dependem do modelo. Mostre ao utilizador apenas controlos confirmados pelo catálogo.

Para ficheiros maiores, crie trabalho em segundo plano no seu produto, para que um tempo limite da rede não defina o fluxo do utilizador.