cicora.ai
API спецификациясыСөйлеу

Аудио

Сөйлеу синтезі, транскрипция және модельге аудио енгізу үшін бөлек операцияларды пайдаланыңыз.

Интеграция анықтамалығы: параметрлер мен қолжетімді мүмкіндіктерді тіркелгіңіздің API параметрлерінен және ортаңызға арналған модельдер каталогынан таңдаңыз.

Сөйлеуді синтездеу

Дыбыстау үшін мәтінді, модельді және таңдалған модельде қолжетімді дауысты жіберіңіз. Жауапты JSON жолы емес, екілік аудио ағыны ретінде өңдеңіз.

Сақтау немесе ойнату алдында нақты жауап пішіміне сай файл кеңейтімін және Content-Type тағайындаңыз.

Мәтіннен сөйлеу жасау сұрауы
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Транскрипция және кіріс

  • Аудио файлды құжатталған пішімінде /audio/transcriptions жолына жіберіңіз.
  • Жүктеп салу басталмай тұрып, файл ұзақтығы мен өлшемін өз тарапыңыздан шектеңіз.
  • Тілді, уақыт белгілерін және сегменттерді таңдалған операция қайтарған жағдайда ғана сақтаңыз.

Сапа және қолжетімділік

Дауыс, пішім, тілдер және синхрондылық модельге байланысты. Пайдаланушыға каталог растаған басқару элементтерін ғана көрсетіңіз.

Ұзынырақ файлдар үшін желі күту уақыты пайдаланушының жұмыс үдерісін анықтамауы үшін өніміңізде фондық жұмыс жасаңыз.