Visão geral
Modelo de preços
A Stac roda em capacidade de GPU dedicada, não em um medidor por token — o que um preço mensal fixo cobre e o que acontece quando você ultrapassa um plano.
A Stac roda em capacidade de GPU dedicada, não em um medidor por token. Você escolhe um plano com base no modelo e nos recursos que seu produto precisa, e essa capacidade é sua — reservada, provisionada e cobrada mensalmente, por antecipação.
O que o preço cobre
Todo plano inclui:
- Um slot de capacidade de GPU para o seu modelo, sempre ativo
- Requisições e tokens ilimitados — sem cobrança por token, sem surpresas baseadas em uso
- Um dashboard com logs de uso e acesso às suas keys
O campo model da sua requisição é ignorado — a Stac sempre roteia para o
modelo que o seu plano está rodando. Você nunca precisa mexer no código do
cliente quando atualizamos o modelo por trás do seu plano.
O que varia
Os planos se acumulam: cada nível inclui tudo do nível abaixo, mais um modelo maior, mais capacidade de busca em documentos e mais controle sobre o comportamento da IA.
Planos
| Plano | Preço | Inclui |
|---|---|---|
| Go | $25/mês | Modelo de IA pronto para uso · Instruções personalizadas para o seu produto · Busca em documentos (RAG) |
| Pro — Mais popular | $65/mês | Tudo do Go · Modelo de IA maior e mais capaz · Busca em documentos (RAG) ampliada · Controle total sobre o comportamento das respostas da IA |
| Max | $180/mês | Tudo do Pro · Fine-tuning com seus próprios dados |
| Enterprise | Personalizado (repositórios e assentos ilimitados) | Capacidade dimensionada para o seu volume · Fine-tuning ilimitado com seus próprios dados · Conformidade com a LGPD via contrato · Logs de auditoria completos · Controles de acesso por usuário/equipe · Suporte prioritário com SLA · Gerente de conta dedicado |
Limites da busca em documentos (RAG)
| Plano | Arquivos | Tamanho máximo por arquivo |
|---|---|---|
| Go | Até 5 | 10MB |
| Pro | Até 20 | 10MB |
| Max | Até 50 | 10MB |
| Enterprise | Personalizado | 10MB |
Requisições nunca são interrompidas
Duas coisas que a Stac faz especificamente para que você nunca receba uma resposta truncada ou rejeitada, independentemente do seu plano:
- Sem teto rígido de tokens. A Stac aplica internamente um piso para quantos tokens uma resposta pode gerar, então um valor baixo ou ausente na sua requisição nunca trunca o modelo no meio do raciocínio antes de ele chegar à resposta.
- Concorrência elástica, não uma rejeição fixa. Não há limite de requisições por key. Se você tiver um pico acima da vazão usual do seu plano, as requisições entram em fila e são concluídas — elas não falham com um erro rígido.
Trocando de plano
- Upgrade tem efeito imediato, com cobrança proporcional pelo restante do
período de faturamento — o campo
modelque você envia continua o mesmo, a Stac só passa a apontá-lo para algo mais capaz. - Downgrade tem efeito no início do próximo período de faturamento; você mantém o que já pagou até lá.
Enterprise
Precisa de capacidade sob medida, fine-tuning ilimitado, logs de auditoria ou um gerente de conta dedicado com SLA? Planos Enterprise são negociados diretamente — fale com a gente.

