cicora.ai
Προδιαγραφή APIΟμιλία

Ήχος

Χρησιμοποιήστε ξεχωριστές λειτουργίες για σύνθεση ομιλίας, μεταγραφή και είσοδο ήχου σε μοντέλο.

Αναφορά ενσωμάτωσης: επιλέξτε παραμέτρους και διαθέσιμες δυνατότητες από τις ρυθμίσεις API του λογαριασμού σας και τον κατάλογο μοντέλων για το περιβάλλον σας.

Σύνθεση ομιλίας

Για αφήγηση, στείλτε κείμενο, μοντέλο και μια φωνή διαθέσιμη στο επιλεγμένο μοντέλο. Χειριστείτε την απάντηση ως δυαδική ροή ήχου και όχι ως συμβολοσειρά JSON.

Ορίστε επέκταση αρχείου και Content-Type από την πραγματική μορφή απάντησης πριν από την αποθήκευση ή αναπαραγωγή.

Αίτημα μετατροπής κειμένου σε ομιλία
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Μεταγραφή και είσοδος

  • Στείλτε αρχείο ήχου στο /audio/transcriptions στην τεκμηριωμένη μορφή του.
  • Περιορίστε τη διάρκεια και το μέγεθος του αρχείου στην πλευρά σας πριν ξεκινήσει η μεταφόρτωση.
  • Διατηρήστε γλώσσα, χρονικές σημάνσεις και τμήματα μόνο αν τα επιστρέφει η επιλεγμένη λειτουργία.

Ποιότητα και διαθεσιμότητα

Η φωνή, η μορφή, οι γλώσσες και ο σύγχρονος ή ασύγχρονος τρόπος εκτέλεσης εξαρτώνται από το μοντέλο. Εμφανίστε στον χρήστη μόνο στοιχεία ελέγχου που επιβεβαιώνονται από τον κατάλογο.

Για μεγαλύτερα αρχεία, δημιουργήστε εργασία παρασκηνίου στο προϊόν σας, ώστε ένα χρονικό όριο δικτύου να μην καθορίζει τη ροή εργασίας του χρήστη.