음성 합성
내레이션에는 텍스트, 모델 및 선택한 모델에서 사용할 수 있는 음성을 보내세요. 응답은 JSON 문자열이 아니라 바이너리 오디오 스트림으로 처리하세요.
저장하거나 재생하기 전에 실제 응답 형식에 따라 파일 확장자와 Content-Type을 지정하세요.
텍스트 음성 변환 요청
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'전사 및 입력
- 문서화된 형식으로 오디오 파일을 /audio/transcriptions에 보내세요.
- 업로드를 시작하기 전에 클라이언트 측에서 파일 재생 시간과 크기를 제한하세요.
- 선택한 작업이 반환한 경우에만 언어, 타임스탬프 및 세그먼트를 유지하세요.
품질 및 가용성
음성, 형식, 언어 및 동기 방식은 모델에 따라 달라집니다. 카탈로그에서 확인된 컨트롤만 사용자에게 표시하세요.
긴 파일은 네트워크 시간 초과가 사용자 워크플로를 좌우하지 않도록 제품에서 백그라운드 작업을 생성하세요.