Visão geral
Introdução
A Stac roda modelos de IA open-source em produção por um preço mensal fixo — nunca por token, nunca interrompido no meio de uma resposta.
Comece aqui
Explore os guias
A Stac é infraestrutura de inferência para modelos de linguagem open-source. Você escolhe um plano, nós rodamos o modelo que esse plano usa em capacidade dedicada, e você paga um preço mensal fixo por essa capacidade. Não há medidor por token, nem fatura surpresa no fim do mês, nem trabalho de DevOps do seu lado.
A API é compatível com a OpenAI, então a maioria dos clientes funciona
mudando duas linhas: a URL base e a API key. Clientes compatíveis com a
Anthropic (como o Claude Code) funcionam da mesma forma, apontando para
/v1/messages.
curl https://api.trystac.com/v1/chat/completions \
-H "Authorization: Bearer $STAC_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "your-stack-model",
"messages": [{ "role": "user", "content": "Hello" }]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.trystac.com/v1",
api_key=os.environ["STAC_API_KEY"],
)
response = client.chat.completions.create(
model="your-stack-model",
messages=[{"role": "user", "content": "Hello"}],
)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.trystac.com/v1",
apiKey: process.env.STAC_API_KEY,
});
const response = await client.chat.completions.create({
model: "your-stack-model",
messages: [{ role: "user", content: "Hello" }],
});Já tem uma integração com OpenAI ou Anthropic? Aponte para
https://api.trystac.com/v1 e ela continua funcionando — mesmo formato de
requisição, mesmo formato de streaming, seu próprio modelo. O campo
model é definido pela sua stack, não pela requisição — você pode deixá-lo
como está ao trocar de provedor.
Por que preço fixo
Preço por token torna o custo uma função de um uso que você não controla. Um loop de retry, um contexto longo ou um pico de tráfego caem todos na mesma fatura, e a única forma de limitar isso é limitar o seu produto.
A Stac inverte essa lógica. Você reserva capacidade — uma stack — e a stack custa o mesmo, sirva ela dez requisições por dia ou dez mil. O que varia é a latência sob carga, não o preço, e isso é algo que dá para planejar.
| Provedores por token | Stac | |
|---|---|---|
| Unidade de cobrança | Tokens de entrada + saída | Capacidade reservada |
| Previsibilidade de custo | Varia com o tráfego | Fixa mensal |
| Interrupções de requisição | Truncadas por cota | Nenhuma |
| Cold starts | Comuns em camadas compartilhadas | Nunca — a capacidade já está reservada |
| Escolha de modelo | Catálogo do provedor | Definida por plano; personalizada no Enterprise |
O que você recebe
Uma stack é um deployment com seu próprio modelo, seu próprio system prompt, sua própria base de conhecimento e suas próprias API keys. Nada da sua configuração é compartilhado com outros clientes.
- Capacidade reservada. Seu tráfego nunca disputa espaço de requisição com o de outro cliente.
- API compatível com OpenAI e Anthropic. Chat completions, streaming, function calling, os dois formatos de requisição.
- Configuração de comportamento. System prompt e parâmetros de geração, editáveis pelo dashboard sem redeploy.
- Base de conhecimento. Envie documentos; a recuperação é feita para você.
- Logs de uso. Cada requisição registrada por modelo, status, tokens e duração.
Próximos passos
Crie uma stack
Escolha um plano. O provisionamento leva poucos minutos.
Gere uma API key
As keys são vinculadas a uma única stack e exibidas apenas uma vez, na criação.
Envie sua primeira requisição
Siga o quickstart — leva cerca de cinco minutos.

