cicora.ai
Specifikacija API-jaGovor

Zvok

Za sintezo govora, prepisovanje in zvočni vhod v model uporabite ločene postopke.

Referenčna dokumentacija za integracijo: parametre in razpoložljive zmožnosti izberite v nastavitvah API-ja svojega računa in v katalogu modelov za svoje okolje.

Sintetizirajte govor

Za pripoved pošljite besedilo, model in glas, ki je na voljo izbranemu modelu. Odgovor obravnavajte kot binarni zvočni tok, ne kot niz JSON.

Pred shranjevanjem ali predvajanjem določite pripono datoteke in Content-Type glede na dejansko obliko odgovora.

Zahteva za pretvorbo besedila v govor
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Prepisovanje in vhod

  • Zvočno datoteko pošljite na /audio/transcriptions v dokumentirani obliki.
  • Pred začetkom nalaganja na svoji strani omejite trajanje in velikost datoteke.
  • Jezik, časovne žige in odseke ohranite le, če jih izbrani postopek vrne.

Kakovost in razpoložljivost

Glas, oblika, jeziki in sinhronost so odvisni od modela. Uporabniku pokažite le kontrolnike, ki jih potrjuje katalog.

Za daljše datoteke v izdelku ustvarite opravilo v ozadju, da omrežna časovna omejitev ne določa uporabniškega poteka dela.