Saltar para o conteúdo

Análise de custo de um agente de longa duração com Opus 5.5

Atualizado September 27, 2026 · publicado originalmente September 27, 2026

Uma demo mostrou o Opus 5.5 trabalhando de forma autônoma por ~25 horas para construir um clone completo de Minecraft: ~100K linhas de código do jogo, 26K linhas de testes, 1,000 testes automatizados, 775 arquivos, 783 imagens geradas, 184 sons gerados e um guia dentro do jogo. É o primeiro vislumbre público de um agente de programação de longo horizonte em escala. Vamos modelar o custo.

Estimando o volume de tokens

Não há contagens oficiais de tokens. Vamos modelar a partir dos artefatos produzidos:

ArtefatoTokens est.Observações
100K linhas de código do jogo~3M de saída~30 tokens/linha em média
26K linhas de testes~0.8M de saída~30 tokens/linha
775 arquivos (estrutura, configuração)~0.5M de saídaCódigo repetitivo + imports
783 imagens (prompts + metadados)~1.5M de entrada~2K tokens/prompt de imagem
184 sons (prompts + metadados)~0.4M de entrada~2K tokens/prompt de som
Guia dentro do jogo / documentação~0.3M de saídaMarkdown + trechos de código
Contexto / raciocínio (25 h)~10M de entradaChamadas de ferramentas, observações, planejamento
Estimativa total~12.4M de entrada / ~4.6M de saída

Custo com os preços do Opus 5.5

Tipo de tokenVolumeTarifaCusto
Entrada (sem cache, est. 30%)3.7M$4.00/MTok$14.80
Entrada (em cache, est. 70%)8.7M$0.20/MTok$1.74
Saída4.6M$20.00/MTok$92.00
Total~$108.54

~$109 por uma execução autônoma de agente de 25 horas que produz um jogo pronto para lançar. São ~$4.36/hora de computação do agente.

Sensibilidade: a taxa de acerto do cache é o que mais pesa

Taxa de acerto do cacheCusto de entradaCusto totalCusto/hora
50%$24.80$131.60$5.26
70% (base)$16.54$108.54$4.34
90%$8.88$92.88$3.72

Com 90% de acerto de cache (alcançável com boa gestão de contexto), a execução cai para $93 no total / $3.72/h.

Comparação: um desenvolvedor humano

Um desenvolvedor sênior construindo isso sozinho: 3-6 semanas (~120-240 horas) a $100-200/h = $12K-$48K. A execução do agente, a $109, é 100-400x mais barata — mas só se a qualidade do resultado passar pelo seu critério de lançamento.

O que isso significa para o orçamento dos seus agentes

  1. Agentes de longo horizonte são acessíveis. Menos de $150 por uma construção complexa de 25 horas muda a conta do ROI dos fluxos de trabalho centrados em agentes.
  2. O cache é a alavanca. Invista em infraestrutura de prompt caching — cada melhora de 10% na taxa de acerto do cache economiza ~$1.60 numa execução como esta.
  3. Os tokens de saída dominam. A $20/MTok, a saída é 85% da fatura. Modelos mais concisos (a Anthropic afirma 40% menos verbosidade) reduzem o custo diretamente.
  4. Monitore por execução, não por mês. As cargas de trabalho de agentes são irregulares. Acompanhe o custo por tarefa concluída, não o gasto mensal agregado.

Leituras relacionadas

Veja o modelo de custos do Claude Opus 5.5, a economia dos agentes, a economia do prompt caching e o custo por tarefa bem-sucedida.

Artigos relacionados


Quer aplicar isto à sua plataforma? Traga as faturas dos fornecedores, os registos do gateway e os principais fluxos de trabalho; mapearemos os custos e as oportunidades de poupança. Marcar auditoria gratuita →

Voltar a finopsllm.com