cicora.ai
API-specifikationTal

Ljud

Använd separata åtgärder för talsyntes, transkribering och ljudindata till en modell.

Integrationsreferens: välj parametrar och tillgängliga funktioner från API-inställningarna för ditt konto och modellkatalogen för din miljö.

Syntetisera tal

För berättarröst skickar du text, modell och en röst som är tillgänglig för den valda modellen. Hantera svaret som en binär ljudström, inte som en JSON-sträng.

Tilldela ett filnamnstillägg och Content-Type utifrån det faktiska svarsformatet innan filen sparas eller spelas upp.

Begäran om text-till-tal
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transkribering och indata

  • Skicka en ljudfil till /audio/transcriptions i dess dokumenterade format.
  • Begränsa filens längd och storlek på din sida innan uppladdningen börjar.
  • Behåll endast språk, tidsstämplar och segment om den valda åtgärden returnerar dem.

Kvalitet och tillgänglighet

Röst, format, språk och synkronitet beror på modellen. Visa användaren endast kontroller som katalogen bekräftar.

För längre filer ska du skapa bakgrundsarbete i produkten så att en nätverkstimeout inte definierar användarens arbetsflöde.