cicora.ai
API 사양음성

오디오

음성 합성, 전사 및 모델의 오디오 입력에는 각각 별도의 작업을 사용하세요.

통합 참조: 계정 API 설정과 환경용 모델 카탈로그에서 매개변수와 사용 가능한 기능을 선택하세요.

음성 합성

내레이션에는 텍스트, 모델 및 선택한 모델에서 사용할 수 있는 음성을 보내세요. 응답은 JSON 문자열이 아니라 바이너리 오디오 스트림으로 처리하세요.

저장하거나 재생하기 전에 실제 응답 형식에 따라 파일 확장자와 Content-Type을 지정하세요.

텍스트 음성 변환 요청
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

전사 및 입력

  • 문서화된 형식으로 오디오 파일을 /audio/transcriptions에 보내세요.
  • 업로드를 시작하기 전에 클라이언트 측에서 파일 재생 시간과 크기를 제한하세요.
  • 선택한 작업이 반환한 경우에만 언어, 타임스탬프 및 세그먼트를 유지하세요.

품질 및 가용성

음성, 형식, 언어 및 동기 방식은 모델에 따라 달라집니다. 카탈로그에서 확인된 컨트롤만 사용자에게 표시하세요.

긴 파일은 네트워크 시간 초과가 사용자 워크플로를 좌우하지 않도록 제품에서 백그라운드 작업을 생성하세요.