Beszéd szintetizálása
Narrációhoz küldje el a szöveget, a modellt és a kiválasztott modell számára elérhető hangot. A választ bináris hangstreamként kezelje, ne JSON-karakterláncként.
Mentés vagy lejátszás előtt a tényleges válaszformátum alapján rendeljen fájlkiterjesztést és Content-Type értéket.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Átírás és bemenet
- A hangfájlt a dokumentált formátumban küldje az /audio/transcriptions útvonalra.
- A feltöltés megkezdése előtt a saját oldalán korlátozza a fájl időtartamát és méretét.
- A nyelvet, időbélyegeket és szegmenseket csak akkor őrizze meg, ha a kiválasztott művelet visszaadja őket.
Minőség és elérhetőség
A hang, formátum, nyelvek és szinkron működés a modelltől függ. Csak a katalógus által megerősített vezérlőket mutassa a felhasználónak.
Hosszabb fájloknál hozzon létre háttérmunkát a termékben, hogy ne a hálózati időtúllépés határozza meg a felhasználói munkafolyamatot.