Syntéza řeči
Pro namluvení odešlete text, model a hlas dostupný pro zvolený model. Odpověď zpracujte jako binární zvukový stream, nikoli jako řetězec JSON.
Před uložením nebo přehráním přiřaďte příponu souboru a Content-Type podle skutečného formátu odpovědi.
Požadavek na převod textu na řeč
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Přepis a vstup
- Odešlete zvukový soubor do /audio/transcriptions v jeho zdokumentovaném formátu.
- Ještě před zahájením nahrávání omezte na své straně délku a velikost souboru.
- Jazyk, časová razítka a segmenty uchovávejte pouze tehdy, pokud je zvolená operace vrací.
Kvalita a dostupnost
Hlas, formát, jazyky a synchronnost závisí na modelu. Uživateli zobrazujte pouze ovládací prvky potvrzené katalogem.
U delších souborů vytvářejte ve svém produktu úlohy na pozadí, aby pracovní postup uživatele neurčoval síťový časový limit.