cicora.ai
Specifikace APIŘeč

Zvuk

Pro syntézu řeči, přepis a zvukový vstup do modelu používejte samostatné operace.

Referenční dokumentace integrace: parametry a dostupné možnosti vybírejte v nastavení API svého účtu a v katalogu modelů pro své prostředí.

Syntéza řeči

Pro namluvení odešlete text, model a hlas dostupný pro zvolený model. Odpověď zpracujte jako binární zvukový stream, nikoli jako řetězec JSON.

Před uložením nebo přehráním přiřaďte příponu souboru a Content-Type podle skutečného formátu odpovědi.

Požadavek na převod textu na řeč
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Přepis a vstup

  • Odešlete zvukový soubor do /audio/transcriptions v jeho zdokumentovaném formátu.
  • Ještě před zahájením nahrávání omezte na své straně délku a velikost souboru.
  • Jazyk, časová razítka a segmenty uchovávejte pouze tehdy, pokud je zvolená operace vrací.

Kvalita a dostupnost

Hlas, formát, jazyky a synchronnost závisí na modelu. Uživateli zobrazujte pouze ovládací prvky potvrzené katalogem.

U delších souborů vytvářejte ve svém produktu úlohy na pozadí, aby pracovní postup uživatele neurčoval síťový časový limit.