cicora.ai
Especificación de la APIVoz

Audio

Usa operaciones separadas para síntesis de voz, transcripción y entrada de audio a un modelo.

Referencia de integración: elige los parámetros y las capacidades disponibles en la configuración de la API de tu cuenta y en el catálogo de modelos de tu entorno.

Sintetiza voz

Para narración, envía texto, modelo y una voz disponible para el modelo elegido. Gestiona la respuesta como flujo de audio binario, no como cadena JSON.

Asigna extensión y Content-Type según el formato real de respuesta antes de guardar o reproducir.

Solicitud de texto a voz
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transcripción y entrada

  • Envía un archivo de audio a /audio/transcriptions en el formato documentado.
  • Limita la duración y el tamaño del archivo en tu sistema antes de iniciar la carga.
  • Conserva idioma, marcas de tiempo y segmentos solo si la operación seleccionada los devuelve.

Calidad y disponibilidad

La voz, el formato, los idiomas y la sincronía dependen del modelo. Muestra solo controles confirmados por el catálogo.

Para archivos largos, crea trabajo en segundo plano en tu producto para que un tiempo de espera agotado en la red no defina el flujo del usuario.