cicora.ai
Specifica APIVoce

Audio

Usa operazioni separate per sintesi vocale, trascrizione e input audio a un modello.

Riferimento per l'integrazione: scegli i parametri e le funzionalità disponibili dalle impostazioni API del tuo account e dal catalogo dei modelli per il tuo ambiente.

Sintetizza la voce

Per la narrazione, invia testo, modello e una voce disponibile per il modello selezionato. Gestisci la risposta come stream audio binario, non come stringa JSON.

Assegna un'estensione di file e un Content-Type in base al formato effettivo della risposta prima di salvare o riprodurre il file.

Richiesta di sintesi vocale
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Trascrizione e input

  • Invia un file audio a /audio/transcriptions nel formato documentato.
  • Limita la durata e la dimensione del file dal tuo lato, prima che inizi il caricamento.
  • Conserva lingua, timestamp e segmenti solo se l'operazione selezionata li restituisce.

Qualità e disponibilità

Voce, formato, lingue e sincronicità dipendono dal modello. Mostra all'utente solo i controlli confermati dal catalogo.

Per i file più lunghi, crea un processo in background nel tuo prodotto, affinché un timeout di rete non definisca il flusso di lavoro dell'utente.