cicora.ai
API specifikacijaKalba

Garsas

Kalbos sintezei, transkribavimui ir garso įvesčiai į modelį naudokite atskiras operacijas.

Integracijų žinynas: savo paskyros API nustatymuose ir jūsų aplinkos modelių kataloge pasirinkite parametrus bei galimas funkcijas.

Sintezuokite kalbą

Įgarsinimui siųskite tekstą, modelį ir pasirinktam modeliui prieinamą balsą. Atsakymą apdorokite kaip dvejetainį garso srautą, o ne JSON eilutę.

Prieš išsaugodami ar paleisdami atsakymą, pagal faktinį jo formatą priskirkite failo plėtinį ir Content-Type.

Teksto pavertimo kalba užklausa
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transkribavimas ir įvestis

  • Garso failą siųskite į /audio/transcriptions dokumentuotu formatu.
  • Dar prieš pradedant įkėlimą savo pusėje apribokite failo trukmę ir dydį.
  • Kalbą, laiko žymas ir segmentus išsaugokite tik tada, jei pasirinkta operacija juos grąžina.

Kokybė ir prieinamumas

Balsas, formatas, kalbos ir sinchroniškumas priklauso nuo modelio. Naudotojui rodykite tik katalogo patvirtintus valdiklius.

Ilgesniems failams savo produkte sukurkite foninę užduotį, kad tinklo skirtasis laikas neapibrėžtų naudotojo darbo eigos.