Spécification de l’API
Référence pour les intégrations dans les flux de travail de texte, d’agents, de médias et de recherche d’information.
https://cicora.ai/api/v1https://cicora.ai/apiRéférence d’intégration : choisissez les paramètres et les capacités disponibles dans les réglages de l’API de votre compte et dans le catalogue de modèles de votre environnement.
Envoyer une première requêtePrise en main
Envoyez une première requête, sélectionnez un modèle dans le catalogue et conservez un identifiant de requête à des fins de diagnostic.
AuthentificationEnvoyez une clé d’API dans un en-tête Bearer et séparez les identifiants de production de ceux du développement.
SDK et clients HTTPUtilisez des URL de base différentes pour les clients de type OpenAI et les clients Messages : ils ciblent une même spécification, mais composent les chemins différemment.
CLI et intégrationsConfigurez un client avec une clé, un modèle et une URL de base correspondant à son protocole ; conservez le secret dans l’environnement.
FAQ des développeursRéponses pratiques et concises sur les clés, les URL de base, les modèles, les coûts et le diagnostic des intégrations.
Compte et catalogue
Construisez la sélection des modèles à partir des données du catalogue plutôt qu’à partir d’une liste codée en dur dans votre application.
Équipes et clés d’APISéparez les clés, les responsables, les budgets et les traces d’utilisation entre les applications et les espaces de travail.
LimitesConsidérez les limites liées à la clé, à l’organisation, au modèle et au routage comme des éléments du flux de travail de l’utilisateur.
Utilisation et coûtReliez les métadonnées de réponse et vos propres journaux de requêtes aux actions réelles des utilisateurs.
Données et confidentialitéRéduisez au minimum les données transmises, séparez l’identifiant de l’utilisateur final du contenu et contrôlez la conservation dans votre produit.
Texte et agents
Créez des conversations à plusieurs tours dans le format messages habituel et sélectionnez un modèle pour chaque requête.
API MessagesUtilisez le format Messages pour les conversations dotées d’une instruction system de niveau supérieur et d’une limite de sortie explicite.
API ResponsesUtilisez un seul objet input lorsque votre application tire parti du traitement des éléments de sortie et des actions dans un modèle de données unique.
Diffusion continueRecevez les jetons et les deltas structurés via SSE sans attendre la réponse complète.
Outils et appels de fonctionsDécrivez les fonctions avec JSON Schema, exécutez l’appel dans votre application et renvoyez le résultat à la conversation.
Sorties structuréesDemandez un objet JSON ou un JSON Schema lorsque la réponse sera utilisée par un logiciel plutôt que par une personne.
RaisonnementDéfinissez l’effort de raisonnement pour chaque requête uniquement pour les modèles qui déclarent cette capacité.
RoutageExprimez les exigences d’exécution dans les préférences relatives aux fournisseurs et conservez le résultat réel à des fins d’observabilité.
Mise en cache du contexteSéparez le contexte récurrent afin qu’un client puisse utiliser une mise en cache compatible lorsque le modèle choisi la prend en charge.
Recherche webRécupérez des sources récentes au moyen d’une fonction `web_search` exécutée par le client et conservez les liens séparément du texte généré.
Médias et récupération
Téléversez un fichier au moyen d’une opération dédiée, conservez son ID et transmettez une référence dans une requête compatible ultérieure.
ImagesCréez des images via une seule route et sélectionnez les paramètres selon les capacités du modèle choisi.
VidéoLancez la création de la vidéo comme une tâche asynchrone, conservez son ID et séparez la création de la lecture du résultat.
AudioUtilisez des opérations distinctes pour la synthèse vocale, la transcription et l’entrée audio d’un modèle.
EmbeddingsTransformez du texte ou des entrées compatibles en vecteurs pour la recherche, le regroupement et les recommandations.
ReclassementRéordonnez un petit ensemble de candidats par rapport à une requête afin d’améliorer la précision de la récupération finale.
Exécution par lotTraitez les opérations indépendantes en groupes contrôlés lorsque le flux de travail permet une livraison asynchrone.