Números reais, não páginas de preços: codificação agêntica diária em APIs cobradas por token custa cerca de US$ 13 por desenvolvedor por dia ativo — US$ 150–250 por mês — segundo dados corporativos da própria Anthropic. Automação pesada (agentes em paralelo, loops longos) chega a US$ 500–2.000/mês em preço de tabela. Assinaturas comprimem isso: planos de US$ 20 com janelas de uso (Claude Pro, ChatGPT Plus) para uso interativo, planos de modelos abertos por US$ 10–20 para volume, ou orçamentos fixos roteados de US$ 19–249. Uma única tarefa agêntica consome comumente 400 mil a 2 milhões de tokens — por isso a diferença entre o custo de um chat e o de um agente é de 10 a 100 vezes.
| Perfil | Custo em API medida | Equivalente em assinatura |
|---|---|---|
| Casual (algumas sessões/semana) | US$ 5–30/mês | US$ 0–20 — um plano de US$ 20 com janelas costuma bastar |
| Uso diário (agente quase todo dia) | US$ 150–250/mês | Plano de US$ 20 + excedente, ou planos fixos de US$ 39–100 |
| Pesado (loops longos, agentes paralelos) | US$ 500–2.000/mês | Tiers máximos de US$ 100–200 ou orçamentos fixos de US$ 89–249 |
| Equipe (por desenvolvedor) | US$ 150–250/dev/mês | Assentos de US$ 19–125/dev + orçamento de computação compartilhado |
Valores medidos: dados corporativos da Anthropic relatados em análises de 2026; a matemática de tokens é corroborada por faturas relatadas por usuários.
Uma pergunta de chat é uma requisição. Uma tarefa de agente é um loop: ler arquivos, planejar, editar, rodar ferramentas, verificar — dezenas de chamadas, cada uma carregando contexto. Sessões instrumentadas mostram 40–80 mil tokens consumidos antes de qualquer código ser escrito, e uma tarefa completa consome 400 mil a 2 milhões de tokens acumulados.
O harness importa tanto quanto o modelo: uma comparação famosa de 2026 mostrou um agente enviando 33 mil tokens de preâmbulo antes de ler o prompt, enquanto outro enviava 7 mil. Mesma tarefa, mesmo modelo, ~5x a conta. Harnesses eficientes em tokens — e roteadores que mantêm etapas rotineiras fora dos modelos de fronteira — são recursos de custo, não conveniências.
O preço publicado de um plano diz quase nada — a diferença entre um plano de US$ 20 que te cobre e um que você estoura em quatro dias é o seu consumo de tokens, que depende do harness, da mistura de modelos e de quão agêntico é o seu trabalho. Meça uma semana real antes de assinar qualquer tier.
A Standard Compute existe para as faixas média e pesada: planos fixos a partir de US$ 19/mês (Starter) até US$ 39/89/249, com tiers empresariais acima — cada um é um orçamento mensal de computação com roteamento inteligente: modelos de fronteira nas requisições difíceis, modelos eficientes nas rotineiras. Endpoint compatível com OpenAI (api.stdcmpt.com/v1), funciona com OpenCode, Aider, Cline e Claude Code; o painel mostra o orçamento ao vivo — 'quanto custa meu agente' finalmente tem resposta exata.
Ordem de grandeza: uma tarefa substancial consome 400 mil a 2 milhões de tokens acumulados; um dia ativo chega facilmente a vários milhões. A preços de tabela de modelos de fronteira, isso dá US$ 10–30/dia — o que bate com a média corporativa de ~US$ 13/dia ativo da Anthropic.
Planos de modelos abertos (US$ 10–20) se a qualidade de modelos de pesos abertos cobre seu trabalho; um plano fixo roteado a partir de US$ 19/mês se você precisa de qualidade de fronteira na mistura. API de fronteira medida é a opção diária mais cara por larga margem.
Preço fixo existe; computação infinita, não. Planos flat como os da Standard Compute trocam o medidor por um orçamento mensal de computação — o preço não muda com o uso, mas o orçamento é real. Veja também nossa página em português sobre API de LLM com assinatura mensal (/api-llm-ilimitada).