cicora.ai
Spécification de l’APIParole

Audio

Utilisez des opérations distinctes pour la synthèse vocale, la transcription et l’entrée audio d’un modèle.

Référence d’intégration : choisissez les paramètres et les capacités disponibles dans les réglages de l’API de votre compte et dans le catalogue de modèles de votre environnement.

Synthétiser la parole

Pour une narration, envoyez le texte, le modèle et une voix disponible pour le modèle sélectionné. Traitez la réponse comme un flux audio binaire, et non comme une chaîne JSON.

Attribuez une extension de fichier et un Content-Type à partir du format réel de la réponse avant de l’enregistrer ou de la lire.

Requête de synthèse vocale
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transcription et entrée

  • Envoyez un fichier audio à /audio/transcriptions dans le format documenté.
  • Limitez de votre côté la durée et la taille du fichier avant le début du téléversement.
  • Ne conservez la langue, les horodatages et les segments que si l’opération sélectionnée les renvoie.

Qualité et disponibilité

La voix, le format, les langues et le caractère synchrone dépendent du modèle. N’affichez à l’utilisateur que les réglages confirmés par le catalogue.

Pour les fichiers plus longs, créez un travail en arrière-plan dans votre produit afin qu’un délai d’expiration réseau ne détermine pas le flux de travail de l’utilisateur.