Vista general
Introducción
Stac ejecuta modelos de IA open-source en producción por un precio mensual fijo — nunca por token, nunca interrumpido a mitad de una respuesta.
Empieza aquí
Explora las guías
Stac es infraestructura de inferencia para modelos de lenguaje open-source. Eliges un plan, nosotros ejecutamos el modelo que ese plan usa en capacidad dedicada, y pagas un precio mensual fijo por esa capacidad. No hay medidor por token, ni factura sorpresa a fin de mes, ni trabajo de DevOps de tu parte.
La API es compatible con OpenAI, así que la mayoría de los clientes
funcionan cambiando dos líneas: la URL base y la API key. Los clientes
compatibles con Anthropic (como Claude Code) funcionan igual, apuntando a
/v1/messages.
curl https://api.trystac.com/v1/chat/completions \
-H "Authorization: Bearer $STAC_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "your-stack-model",
"messages": [{ "role": "user", "content": "Hello" }]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.trystac.com/v1",
api_key=os.environ["STAC_API_KEY"],
)
response = client.chat.completions.create(
model="your-stack-model",
messages=[{"role": "user", "content": "Hello"}],
)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.trystac.com/v1",
apiKey: process.env.STAC_API_KEY,
});
const response = await client.chat.completions.create({
model: "your-stack-model",
messages: [{ role: "user", content: "Hello" }],
});¿Ya tienes una integración con OpenAI o Anthropic? Apúntala a
https://api.trystac.com/v1 y seguirá funcionando — misma forma de
solicitud, mismo formato de streaming, tu propio modelo. El campo model
lo define tu stack, no la solicitud — puedes dejarlo tal cual al cambiar
de proveedor.
Por qué precio fijo
El precio por token convierte el costo en una función de un uso que no controlas. Un bucle de reintentos, un contexto largo o un pico de tráfico terminan en la misma factura, y la única forma de limitarlo es limitar tu producto.
Stac invierte esa lógica. Reservas capacidad — un stack — y el stack cuesta lo mismo, ya sirva diez solicitudes al día o diez mil. Lo que varía es la latencia bajo carga, no el precio, y eso sí se puede planificar.
| Proveedores por token | Stac | |
|---|---|---|
| Unidad de facturación | Tokens de entrada + salida | Capacidad reservada |
| Previsibilidad de costo | Varía con el tráfico | Fija mensual |
| Cortes de solicitud | Truncadas por cuota | Ninguno |
| Cold starts | Comunes en niveles compartidos | Nunca — la capacidad ya está reservada |
| Elección de modelo | Catálogo del proveedor | Definida por plan; personalizada en Enterprise |
Qué obtienes
Un stack es un despliegue con su propio modelo, su propio system prompt, su propia base de conocimiento y sus propias API keys. Nada de tu configuración se comparte con otros clientes.
- Capacidad reservada. Tu tráfico nunca compite por espacio de solicitud con el de otro cliente.
- API compatible con OpenAI y Anthropic. Chat completions, streaming, function calling, ambos formatos de solicitud.
- Configuración de comportamiento. System prompt y parámetros de generación, editables desde el dashboard sin redeploy.
- Base de conocimiento. Sube documentos; la recuperación se gestiona por ti.
- Registros de uso. Cada solicitud registrada por modelo, estado, tokens y duración.
Próximos pasos
Crea un stack
Elige un plan. El aprovisionamiento toma unos minutos.
Genera una API key
Las keys están vinculadas a un solo stack y se muestran una única vez, al crearlas.
Envía tu primera solicitud
Sigue el quickstart — toma unos cinco minutos.

