Vista general
Modelo de precios
Stac corre sobre capacidad de GPU dedicada, no sobre un medidor por token — qué cubre un precio mensual fijo y qué pasa cuando superas un plan.
Stac corre sobre capacidad de GPU dedicada, no sobre un medidor por token. Eliges un plan según el modelo y las funciones que tu producto necesita, y esa capacidad es tuya — reservada, aprovisionada y facturada mensualmente, por adelantado.
Qué cubre el precio
Todo plan incluye:
- Un slot de capacidad de GPU para tu modelo, siempre activo
- Solicitudes y tokens ilimitados — sin cargos por token, sin sorpresas basadas en el uso
- Un dashboard con logs de uso y acceso a tus keys
El campo model de tu solicitud se ignora — Stac siempre enruta al modelo
que tu plan está ejecutando. Nunca necesitas tocar el código del cliente
cuando actualizamos el modelo detrás de tu plan.
Qué varía
Los planes se acumulan: cada nivel incluye todo lo del nivel anterior, más un modelo más grande, más capacidad de búsqueda en documentos y más control sobre el comportamiento de la IA.
Planes
| Plan | Precio | Incluye |
|---|---|---|
| Go | $25/mes | Modelo de IA listo para usar · Instrucciones personalizadas para tu producto · Búsqueda en documentos (RAG) |
| Pro — El más popular | $65/mes | Todo de Go · Modelo de IA más grande y capaz · Búsqueda en documentos (RAG) ampliada · Control total sobre el comportamiento de las respuestas de la IA |
| Max | $180/mes | Todo de Pro · Fine-tuning con tus propios datos |
| Enterprise | Personalizado (repositorios y asientos ilimitados) | Capacidad dimensionada para tu volumen · Fine-tuning ilimitado con tus propios datos · Cumplimiento de LGPD por contrato · Logs de auditoría completos · Controles de acceso por usuario/equipo · Soporte prioritario con SLA · Gerente de cuenta dedicado |
Límites de búsqueda en documentos (RAG)
| Plan | Archivos | Tamaño máximo por archivo |
|---|---|---|
| Go | Hasta 5 | 10MB |
| Pro | Hasta 20 | 10MB |
| Max | Hasta 50 | 10MB |
| Enterprise | Personalizado | 10MB |
Las solicitudes nunca se interrumpen
Dos cosas que Stac hace específicamente para que nunca recibas una respuesta truncada o rechazada, sin importar tu plan:
- Sin techo rígido de tokens. Stac aplica internamente un piso sobre cuántos tokens puede generar una respuesta, así que un valor bajo o ausente en tu solicitud nunca trunca al modelo a mitad de su razonamiento antes de llegar a la respuesta.
- Concurrencia elástica, no un rechazo fijo. No hay límite de solicitudes por key. Si tienes un pico por encima del rendimiento habitual de tu plan, las solicitudes se encolan y se completan — no fallan con un error rígido.
Cambiar de plan
- El upgrade tiene efecto inmediato, con un cargo prorrateado por el resto
del período de facturación — el campo
modelque envías sigue siendo el mismo, Stac solo lo apunta a algo más capaz. - El downgrade tiene efecto al inicio de tu próximo período de facturación; conservas lo que ya pagaste hasta entonces.
Enterprise
¿Necesitas capacidad a medida, fine-tuning ilimitado, logs de auditoría o un gerente de cuenta dedicado con SLA? Los planes Enterprise se negocian directamente — habla con nosotros.

