Synthétiser la parole
Pour une narration, envoyez le texte, le modèle et une voix disponible pour le modèle sélectionné. Traitez la réponse comme un flux audio binaire, et non comme une chaîne JSON.
Attribuez une extension de fichier et un Content-Type à partir du format réel de la réponse avant de l’enregistrer ou de la lire.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Transcription et entrée
- Envoyez un fichier audio à /audio/transcriptions dans le format documenté.
- Limitez de votre côté la durée et la taille du fichier avant le début du téléversement.
- Ne conservez la langue, les horodatages et les segments que si l’opération sélectionnée les renvoie.
Qualité et disponibilité
La voix, le format, les langues et le caractère synchrone dépendent du modèle. N’affichez à l’utilisateur que les réglages confirmés par le catalogue.
Pour les fichiers plus longs, créez un travail en arrière-plan dans votre produit afin qu’un délai d’expiration réseau ne détermine pas le flux de travail de l’utilisateur.