cicora.ai
API-specificatieSpraak

Audio

Gebruik afzonderlijke bewerkingen voor spraaksynthese, transcriptie en audio-invoer naar een model.

Integratiereferentie: kies parameters en beschikbare mogelijkheden uit de API-instellingen van uw account en de modelcatalogus voor uw omgeving.

Spraak synthetiseren

Wilt u tekst laten voorlezen, stuur dan de tekst, het model en een stem die beschikbaar is voor het geselecteerde model. Verwerk het antwoord als binaire audiostream, niet als JSON-tekenreeks.

Ken vóór opslag of afspelen een bestandsextensie en Content-Type toe op basis van de werkelijke antwoordindeling.

Tekst-naar-spraak-aanvraag
bash
curl --request POST https://cicora.ai/api/v1/audio/speech \
  --header "Authorization: Bearer $CICORA_API_KEY" \
  --header 'Content-Type: application/json' \
  --output narration.mp3 \
  --data '{
    "model": "mistralai/voxtral-mini-tts-2603",
    "voice": "en_paul_neutral",
    "input": "Your delivery is scheduled for tomorrow.",
    "response_format": "mp3"
  }'

Transcriptie en invoer

  • Stuur een audiobestand in de gedocumenteerde indeling naar /audio/transcriptions.
  • Beperk de duur en grootte van bestanden aan uw kant voordat het uploaden begint.
  • Bewaar taal, tijdstempels en segmenten alleen als de geselecteerde bewerking ze retourneert.

Kwaliteit en beschikbaarheid

Stem, indeling, talen en synchroniciteit hangen af van het model. Toon een gebruiker alleen bedieningselementen die door de catalogus zijn bevestigd.

Maak voor langere bestanden achtergrondtaken aan in uw product, zodat een netwerktime-out de gebruikersworkflow niet bepaalt.