Vista general

Introducción

Stac ejecuta modelos de IA open-source en producción por un precio mensual fijo — nunca por token, nunca interrumpido a mitad de una respuesta.

Stac es infraestructura de inferencia para modelos de lenguaje open-source. Eliges un plan, nosotros ejecutamos el modelo que ese plan usa en capacidad dedicada, y pagas un precio mensual fijo por esa capacidad. No hay medidor por token, ni factura sorpresa a fin de mes, ni trabajo de DevOps de tu parte.

La API es compatible con OpenAI, así que la mayoría de los clientes funcionan cambiando dos líneas: la URL base y la API key. Los clientes compatibles con Anthropic (como Claude Code) funcionan igual, apuntando a /v1/messages.

bash
curl https://api.trystac.com/v1/chat/completions \
  -H "Authorization: Bearer $STAC_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "your-stack-model",
    "messages": [{ "role": "user", "content": "Hello" }]
  }'

Por qué precio fijo

El precio por token convierte el costo en una función de un uso que no controlas. Un bucle de reintentos, un contexto largo o un pico de tráfico terminan en la misma factura, y la única forma de limitarlo es limitar tu producto.

Stac invierte esa lógica. Reservas capacidad — un stack — y el stack cuesta lo mismo, ya sirva diez solicitudes al día o diez mil. Lo que varía es la latencia bajo carga, no el precio, y eso sí se puede planificar.

Proveedores por tokenStac
Unidad de facturaciónTokens de entrada + salidaCapacidad reservada
Previsibilidad de costoVaría con el tráficoFija mensual
Cortes de solicitudTruncadas por cuotaNinguno
Cold startsComunes en niveles compartidosNunca — la capacidad ya está reservada
Elección de modeloCatálogo del proveedorDefinida por plan; personalizada en Enterprise

Qué obtienes

Un stack es un despliegue con su propio modelo, su propio system prompt, su propia base de conocimiento y sus propias API keys. Nada de tu configuración se comparte con otros clientes.

  • Capacidad reservada. Tu tráfico nunca compite por espacio de solicitud con el de otro cliente.
  • API compatible con OpenAI y Anthropic. Chat completions, streaming, function calling, ambos formatos de solicitud.
  • Configuración de comportamiento. System prompt y parámetros de generación, editables desde el dashboard sin redeploy.
  • Base de conocimiento. Sube documentos; la recuperación se gestiona por ti.
  • Registros de uso. Cada solicitud registrada por modelo, estado, tokens y duración.

Próximos pasos

  1. Crea un stack

    Elige un plan. El aprovisionamiento toma unos minutos.

  2. Genera una API key

    Las keys están vinculadas a un solo stack y se muestran una única vez, al crearlas.

  3. Envía tu primera solicitud

    Sigue el quickstart — toma unos cinco minutos.