Kairness API

Inferencia de IA compatible con OpenAI, con el modelo propio de Kairos alojado en nuestra propia infraestructura (España, sin enviar datos a terceros).

La API replica el formato de OpenAI (/v1/chat/completions), así que cualquier SDK o cliente que ya uses (openai-python, Vercel AI SDK, LangChain…) funciona cambiando solo la base URL y la key.

Base URL  https://api.kairness.com/v1

Autenticación

Cada petición lleva tu API key en la cabecera Authorization. Consigue una key desde el panel de control o pídesela a tu administrador.

Authorization: Bearer TU_API_KEY
La key se muestra una sola vez al crearla. En nuestros sistemas solo vive su hash — si la pierdes, genera otra.

Quickstart

Una petición mínima:

curl https://api.kairness.com/v1/chat/completions \
  -H "Authorization: Bearer TU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kairos",
    "messages": [{"role":"user","content":"Hola, ¿qué eres?"}]
  }'

Chat completions POST /v1/chat/completions

El endpoint principal. Parámetros compatibles con OpenAI:

ParámetroTipoDescripción
modelstringSiempre kairos.
messagesarrayHistorial de la conversación (role + content).
streamboolSi true, respuesta por SSE token a token.
max_tokensintTope de tokens de salida.
temperaturenumber0–2. Por defecto 1.
El campo usage de la respuesta incluye prompt_tokens_details.cached_tokens: la parte de tu prompt servida desde el prefix-cache (más barata). Reutilizar el mismo prefijo entre llamadas ahorra coste.

Streaming (SSE)

Con "stream": true la respuesta llega como text/event-stream: líneas data: {…} con deltas, y data: [DONE] al final.

curl -N https://api.kairness.com/v1/chat/completions \
  -H "Authorization: Bearer TU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kairos","stream":true,
       "messages":[{"role":"user","content":"Cuéntame un chiste"}]}'

Modelos

IDContextoNotas
kairoshasta 256kModelo propio de Kairos. Texto. Self-hosted en GPUs en España.

Precios

La API es de pago por uso: pagas solo por los tokens que consumes, sin suscripción. Precios por millón de tokens (IVA no incluido):

ModeloEntrada / 1MCacheado / 1MSalida / 1M
kairos0,50 €0,10 €2,00 €
Los tokens de entrada servidos desde el prefix-cache (cached_tokens) cuestan mucho menos. Reutilizar el mismo prefijo entre llamadas abarata el coste.

Al superar el rate-limit de tu key recibes 429. ¿Prefieres una cuota mensual fija en vez de pago por uso? Mira los planes.

Errores

CódigoSignificado
401Key ausente, inválida o revocada.
429Rate-limit o cuota mensual superada.
400Cuerpo mal formado (modelo o messages inválidos).
503Modelo temporalmente no disponible.

Panel de control

En platform.kairness.com ves tu plan y tu consumo (tokens, coste, cache-hit) y gestionas tu cuenta.

Kairness · inferencia self-hosted · sin envío de datos a terceros.