cicora.ai
Spesifikasi APIPertuturan

Audio

Gunakan operasi berasingan untuk sintesis pertuturan, transkripsi dan input audio kepada model.

Rujukan penyepaduan: pilih parameter dan keupayaan yang tersedia daripada tetapan API akaun serta katalog model untuk persekitaran anda.

Sintesis pertuturan

Untuk narasi, hantar teks, model dan suara yang tersedia bagi model yang dipilih. Kendalikan respons sebagai strim audio perduaan, bukan rentetan JSON.

Tetapkan sambungan fail dan Content-Type daripada format respons sebenar sebelum menyimpan atau memainkannya.

Permintaan teks kepada pertuturan
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transkripsi dan input

  • Hantar fail audio kepada /audio/transcriptions dalam format yang didokumenkan.
  • Hadkan tempoh dan saiz fail pada pihak anda sebelum muat naik bermula.
  • Simpan bahasa, cap masa dan segmen hanya jika operasi yang dipilih mengembalikannya.

Kualiti dan ketersediaan

Suara, format, bahasa dan kesegerakan bergantung pada model. Tunjukkan kepada pengguna hanya kawalan yang disahkan oleh katalog.

Untuk fail yang lebih panjang, cipta kerja latar belakang dalam produk anda supaya tamat masa rangkaian tidak menentukan aliran kerja pengguna.