Especificación de la API
Referencia para integraciones en flujos de trabajo de texto, agentes, medios y recuperación.
https://cicora.ai/api/v1https://cicora.ai/apiReferencia de integración: elige los parámetros y las capacidades disponibles en la configuración de la API de tu cuenta y en el catálogo de modelos de tu entorno.
Enviar una primera solicitudPrimeros pasos
Envía una primera solicitud, selecciona un modelo del catálogo y conserva un identificador de solicitud para el diagnóstico.
AutenticaciónEnvía una clave API en una cabecera Bearer y mantén separadas las credenciales de producción y desarrollo.
SDK y clientes HTTPUsa URL base distintas para clientes de estilo OpenAI y Messages: apuntan a la misma especificación, pero componen las rutas de forma diferente.
CLI e integracionesConfigura un cliente con clave, modelo y URL base que coincida con su protocolo; guarda el secreto en el entorno.
Preguntas frecuentes para desarrolladoresRespuestas prácticas breves sobre claves, URL base, modelos, coste y diagnóstico de integraciones.
Cuenta y catálogo
Crea la selección de modelos a partir de datos del catálogo, no de una lista fija en tu aplicación.
Equipos y claves APISepara claves, propietarios, presupuestos y trazas de uso entre aplicaciones y espacios de trabajo.
LímitesTrata los límites de clave, organización, modelo y enrutamiento como parte del flujo del usuario.
Uso y costeRelaciona los metadatos de respuesta y tus propios registros de solicitudes con acciones reales del usuario.
Datos y privacidadMinimiza los datos transmitidos, separa el identificador del usuario final del contenido y controla la retención en tu producto.
Texto y agentes
Crea conversaciones de varios turnos con el formato messages habitual y selecciona un modelo en cada solicitud.
API MessagesUsa el formato Messages para conversaciones con una instrucción system de nivel superior y un límite de salida explícito.
API ResponsesUsa un único objeto de entrada cuando tu aplicación se beneficie de gestionar elementos de salida y acciones en un solo modelo de datos.
StreamingRecibe tokens y deltas estructurados por SSE sin esperar la respuesta completa.
Herramientas y llamadas a funcionesDescribe funciones con JSON Schema, ejecuta la llamada en tu aplicación y devuelve el resultado a la conversación.
Salidas estructuradasSolicita un objeto JSON o un JSON Schema cuando la respuesta vaya a ser consumida por software y no por una persona.
RazonamientoEstablece el esfuerzo de razonamiento por solicitud solo para modelos que declaren esta capacidad.
EnrutamientoExpresa los requisitos de ejecución en las preferencias de proveedor y conserva el resultado real para fines de observabilidad.
Caché de contextoSepara el contexto recurrente para que el cliente pueda usar caché compatible cuando el modelo elegido lo admita.
Búsqueda webRecupera fuentes recientes mediante una función `web_search` ejecutada por el cliente y mantén los enlaces separados del texto generado.
Medios y recuperación
Carga un archivo mediante una operación específica, conserva su ID y pasa una referencia en una solicitud compatible posterior.
ImágenesCrea imágenes mediante una sola ruta y selecciona parámetros según las capacidades del modelo elegido.
VídeoInicia el vídeo como trabajo asíncrono, conserva su ID y separa la creación de la lectura del resultado.
AudioUsa operaciones separadas para síntesis de voz, transcripción y entrada de audio a un modelo.
EmbeddingsTransforma texto o entradas compatibles en vectores para búsqueda, agrupación y recomendaciones.
ReclasificaciónReordena un conjunto pequeño de candidatos frente a una consulta para mejorar la precisión de la recuperación final.
Ejecución por lotesProcesa operaciones independientes en grupos controlados cuando el flujo permita la entrega asíncrona.