cicora.ai
API-spesifikasjonTale

Lyd

Bruk separate operasjoner for talesyntese, transkripsjon og lydinndata til en modell.

Integrasjonsreferanse: Velg parametere og tilgjengelige funksjoner fra API-innstillingene for kontoen og modellkatalogen for miljøet ditt.

Syntetiser tale

For opplesning sender du tekst, modell og en stemme som er tilgjengelig for den valgte modellen. Behandle svaret som en binær lydstrøm, ikke en JSON-streng.

Angi filtype og Content-Type ut fra det faktiske svarformatet før filen lagres eller spilles av.

Forespørsel om tekst-til-tale
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transkripsjon og inndata

  • Send en lydfil til /audio/transcriptions i det dokumenterte formatet.
  • Begrens filens varighet og størrelse på din side før opplastingen starter.
  • Behold språk, tidsstempler og segmenter bare dersom den valgte operasjonen returnerer dem.

Kvalitet og tilgjengelighet

Stemme, format, språk og synkronitet avhenger av modellen. Vis brukeren bare kontroller som er bekreftet i katalogen.

For lengre filer oppretter du bakgrunnsarbeid i produktet, slik at et nettverkstidsavbrudd ikke definerer brukerflyten.