Syntetiser tale
For oplæsning sender du tekst, model og en stemme som er tilgængelig for den valgte model. Behandl svaret som en binær lydstream, ikke en JSON-streng.
Angiv filtypenavn og Content-Type ud fra det faktiske svarformat, før filen gemmes eller afspilles.
Anmodning om tekst-til-tale
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Transskription og input
- Send en lydfil til /audio/transcriptions i det dokumenterede format.
- Begræns filens varighed og størrelse på din side før uploaden starter.
- Bevar sprog, tidsstempler og segmenter, men kun hvis den valgte operation returnerer dem.
Kvalitet og tilgængelighed
Stemme, format, sprog og synkronitet afhænger af modellen. Vis brugeren kun kontroller, der er bekræftet i kataloget.
For længere filer opretter du baggrundsarbejde i produktet, så en netværkstimeout ikke bestemmer brugerflowet.