Sintetiza voz
Para narración, envía texto, modelo y una voz disponible para el modelo elegido. Gestiona la respuesta como flujo de audio binario, no como cadena JSON.
Asigna extensión y Content-Type según el formato real de respuesta antes de guardar o reproducir.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Transcripción y entrada
- Envía un archivo de audio a /audio/transcriptions en el formato documentado.
- Limita la duración y el tamaño del archivo en tu sistema antes de iniciar la carga.
- Conserva idioma, marcas de tiempo y segmentos solo si la operación seleccionada los devuelve.
Calidad y disponibilidad
La voz, el formato, los idiomas y la sincronía dependen del modelo. Muestra solo controles confirmados por el catálogo.
Para archivos largos, crea trabajo en segundo plano en tu producto para que un tiempo de espera agotado en la red no defina el flujo del usuario.