توليف الكلام
للسرد الصوتي، أرسل النص والنموذج وصوتًا متاحًا للنموذج المختار. تعامل مع الاستجابة كتدفق صوتي ثنائي، لا كسلسلة JSON.
عيّن امتداد ملف وContent-Type من تنسيق الاستجابة الفعلي قبل الحفظ أو التشغيل.
طلب تحويل النص إلى كلام
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
--header "Authorization: Bearer $CICORA_API_KEY" \
--header 'Content-Type: application/json' \
--output narration.mp3 \
--data '{
"model": "mistralai/voxtral-mini-tts-2603",
"voice": "en_paul_neutral",
"input": "Your delivery is scheduled for tomorrow.",
"response_format": "mp3"
}'النسخ الصوتي والإدخال
- أرسل ملفًا صوتيًا إلى /audio/transcriptions بتنسيقه الموثّق.
- قيّد مدة الملف وحجمه من جهتك قبل بدء الرفع.
- احتفظ باللغة والطوابع الزمنية والمقاطع فقط إذا أعادتها العملية المختارة.
الجودة والتوفر
يعتمد الصوت والتنسيق واللغات والتزامن على النموذج. اعرض للمستخدم فقط عناصر التحكم التي يؤكدها الكتالوج.
للملفات الأطول، أنشئ عملًا في الخلفية داخل منتجك حتى لا يحدد انتهاء مهلة الشبكة سير عمل المستخدم.