Σύνθεση ομιλίας
Για αφήγηση, στείλτε κείμενο, μοντέλο και μια φωνή διαθέσιμη στο επιλεγμένο μοντέλο. Χειριστείτε την απάντηση ως δυαδική ροή ήχου και όχι ως συμβολοσειρά JSON.
Ορίστε επέκταση αρχείου και Content-Type από την πραγματική μορφή απάντησης πριν από την αποθήκευση ή αναπαραγωγή.
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'Μεταγραφή και είσοδος
- Στείλτε αρχείο ήχου στο /audio/transcriptions στην τεκμηριωμένη μορφή του.
- Περιορίστε τη διάρκεια και το μέγεθος του αρχείου στην πλευρά σας πριν ξεκινήσει η μεταφόρτωση.
- Διατηρήστε γλώσσα, χρονικές σημάνσεις και τμήματα μόνο αν τα επιστρέφει η επιλεγμένη λειτουργία.
Ποιότητα και διαθεσιμότητα
Η φωνή, η μορφή, οι γλώσσες και ο σύγχρονος ή ασύγχρονος τρόπος εκτέλεσης εξαρτώνται από το μοντέλο. Εμφανίστε στον χρήστη μόνο στοιχεία ελέγχου που επιβεβαιώνονται από τον κατάλογο.
Για μεγαλύτερα αρχεία, δημιουργήστε εργασία παρασκηνίου στο προϊόν σας, ώστε ένα χρονικό όριο δικτύου να μην καθορίζει τη ροή εργασίας του χρήστη.