cicora.ai
מפרט APIדיבור

שמע

השתמשו בפעולות נפרדות לסינתזת דיבור, לתמלול ולקלט שמע למודל.

מדריך שילוב: בחרו פרמטרים ויכולות זמינות בהגדרות ה-API של החשבון ובקטלוג המודלים של הסביבה שלכם.

סינתזת דיבור

לקריינות, שלחו טקסט, מודל וקול הזמין למודל שנבחר. טפלו בתשובה כזרם שמע בינארי, ולא כמחרוזת JSON.

הקצו סיומת קובץ ו-Content-Type לפי תבנית התשובה בפועל לפני שמירה או הפעלה.

בקשת טקסט לדיבור
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

תמלול וקלט

  • שלחו קובץ שמע ל-/audio/transcriptions בתבנית המתועדת שלו.
  • הגבילו אצלכם את משך הקובץ ואת גודלו לפני תחילת ההעלאה.
  • שמרו שפה, חותמות זמן ומקטעים רק אם הפעולה שנבחרה מחזירה אותם.

איכות וזמינות

קול, תבנית, שפות וסינכרוניות תלויים במודל. הציגו למשתמש רק פקדים שאושרו בקטלוג.

לקבצים ארוכים יותר, צרו עבודת רקע במוצר כדי שפסק זמן ברשת לא יגדיר את תהליך המשתמש.