cicora.ai
API-specifikációBeszéd

Hang

A beszédszintézishez, átíráshoz és modell-hangbemenethez külön műveleteket használjon.

Integrációs referencia: válassza ki a paramétereket és az elérhető képességeket a fiókja API-beállításaiból és a környezetéhez tartozó modellkatalógusból.

Beszéd szintetizálása

Narrációhoz küldje el a szöveget, a modellt és a kiválasztott modell számára elérhető hangot. A választ bináris hangstreamként kezelje, ne JSON-karakterláncként.

Mentés vagy lejátszás előtt a tényleges válaszformátum alapján rendeljen fájlkiterjesztést és Content-Type értéket.

Szövegfelolvasási kérés
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Átírás és bemenet

  • A hangfájlt a dokumentált formátumban küldje az /audio/transcriptions útvonalra.
  • A feltöltés megkezdése előtt a saját oldalán korlátozza a fájl időtartamát és méretét.
  • A nyelvet, időbélyegeket és szegmenseket csak akkor őrizze meg, ha a kiválasztott művelet visszaadja őket.

Minőség és elérhetőség

A hang, formátum, nyelvek és szinkron működés a modelltől függ. Csak a katalógus által megerősített vezérlőket mutassa a felhasználónak.

Hosszabb fájloknál hozzon létre háttérmunkát a termékben, hogy ne a hálózati időtúllépés határozza meg a felhasználói munkafolyamatot.