Imagine a cena: a IA recebe o briefing, organiza as informações, atualiza a planilha e avisa que terminou. Vc abre o arquivo. Faltou uma informação. Outra foi parar no lugar errado. E começa a conferência.
O token custou centavos. A tarde, não.
É com essa conta em mente que eu olharia para os novos GPT-6 Sol e Luna. Na API padrão, fora da faixa de contexto longo, o Sol passou de US$ 4 para US$ 2 por milhão de tokens de entrada, e de US$ 20 para US$ 10 na saída, comparado aos preços promocionais da geração anterior. Metade do preço. O Luna chegou a US$ 0,10 por milhão de tokens de entrada e US$ 0,50 na saída, nas mesmas condições.
A Anthropic também entrou nessa conversa: no lançamento do Claude Opus 5.5, ontem, anunciou custo de uso 40% menor que o Opus 5 em cargas típicas, segundo seus testes, combinando preços menores e menor consumo de tokens.
Ótimas notícias. Mas desconto no processamento e economia por entrega aprovada são contas diferentes. Se a qualidade se mantém, sem aumentar tentativas ou revisão, o preço menor ajuda. O salto indevido é pegar os 50% de redução no token e anunciar 50% de economia na operação.
A hora de quem confere não entrou na promoção.
No AutomationBench, por exemplo, o Sol em configuração xhigh registra 33,2% de conclusão correta, a US$ 0,27 por tarefa. O teste avalia fluxos entre aplicativos simulados e exige que todos os critérios sejam cumpridos. Não basta o agente escrever “concluído”: o resultado precisa estar certo nos sistemas. Isso não prevê a taxa de erro da sua operação nem demonstra que os novos modelos geram mais retrabalho. Mas ajuda a separar duas coisas que eu não colocaria na mesma coluna: tentativa executada e trabalho entregue.
Quanto foi gasto em processamento? Quantas novas tentativas? Quanto tempo alguém levou pra conferir e corrigir?
Pra uma operação criativa, eu somaria tudo e dividiria pelas entregas realmente aproveitáveis, mantendo a mesma régua de qualidade. Pode dar uma economia excelente. Pode dar bem menos do que a manchete sugere. E, se o retrabalho consumir o ganho, o desconto pode desaparecer da conta final.
Porque pagar menos pra IA tentar é uma boa notícia. Pagar menos pelo trabalho pronto é o que interessa









