A Anthropic lançou o Claude Sonnet 5.5 na segunda-feira, 28 de setembro, com uma promessa que parece contraditória. O preço por token é o mesmo do Sonnet 5, e o custo de concluir uma tarefa cai até 30%. A explicação está na unidade de medida. Quem opera agentes de IA não paga por token, paga por trabalho entregue. Se o modelo resolve o mesmo problema com menos tokens e menos chamadas de ferramenta, a fatura cai sem que a tabela mude. Essa é a métrica que uma empresa deveria acompanhar, e o lançamento é um bom motivo para começar.
Resumo: o Claude Sonnet 5.5 custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída, igual ao Sonnet 5. A Anthropic afirma que ele gera saída mais de 30% mais rápido e reduz o custo por tarefa em até 30%, porque usa menos tokens e menos chamadas de ferramenta. Nos benchmarks divulgados pela empresa, fica muito perto do Opus 5.5 por metade do preço por token. São números do fabricante e de clientes selecionados. A decisão de migrar deve sair de um teste com as tarefas da própria operação, medindo custo por tarefa concluída.
Neste artigo
- O que foi lançado
- Por que o custo por tarefa cai se o preço não mudou
- O que os benchmarks mostram
- O que dizem os primeiros clientes
- Quando vale migrar
- Perguntas frequentes
O que foi lançado
O Sonnet é o modelo intermediário da família Claude, abaixo do Opus. Segundo o anúncio da Anthropic, a versão 5.5 está disponível na plataforma da empresa com o identificador claude-sonnet-5-5, além de Amazon Web Services, Google Cloud e Microsoft Azure.
Os preços seguem os do Sonnet 5: US$ 2 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,20 por milhão de tokens lidos do cache. De acordo com a cobertura do MarkTechPost, a janela de contexto é de 1 milhão de tokens, com saída máxima de 128 mil.
Há também uma novidade de segurança. É o primeiro Sonnet com salvaguardas de cibersegurança e com classificadores que bloqueiam tentativas de extrair o raciocínio do modelo, prática usada para copiar capacidades de um modelo para outro.
Por que o custo por tarefa cai se o preço não mudou
Um agente de IA não responde uma pergunta e para. Ele lê arquivos, chama ferramentas, confere o resultado e tenta de novo. Cada passo consome tokens, e cada chamada de ferramenta devolve ao modelo mais texto para processar. Por isso, a fatura de uma tarefa depende de três fatores:
- Preço por token, que está na tabela;
- Tokens consumidos, que dependem de quanto o modelo escreve e relê;
- Número de passos, que depende de quantas tentativas ele precisa.
A Anthropic manteve o primeiro fator e afirma ter reduzido os outros dois. Segundo o VentureBeat, a empresa atribui a economia a menos tokens, menos chamadas de ferramenta e geração mais rápida.
Um exemplo hipotético ajuda. Imagine uma tarefa que consumia 400 mil tokens de entrada e 40 mil de saída. Pela tabela, ela custava US$ 1,20. Se o modelo novo resolve a mesma tarefa com 30% menos tokens, o custo cai para US$ 0,84. O preço não mudou, e a conta ficou menor. Os números são ilustrativos. O valor real depende da tarefa.
Esse raciocínio vale para qualquer fornecedor. Em Jev: a IA 400x mais barata que o ChatGPT, mostrei o outro lado da moeda: preço baixo por token não serve de nada quando o modelo não entrega o trabalho.
O que os benchmarks mostram
A Anthropic publicou os resultados abaixo. São números do fabricante e devem ser lidos como tal.
| Benchmark | Sonnet 5 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 (tarefas em terminal) | 10,3% | 70,6% | 66,4% |
| OSWorld 2.1 (uso de computador) | 57,0% | 80,1% | 81,8% |
| CursorBench 4.0 (programação) | 34,1% | 55,5% | 57,8% |
| FrontierCode 1.1 (programação difícil) | 42,4% | 46,2% | 54,4% |
| GDPval-AA v2.1 (trabalho de conhecimento) | 1.449 | 1.844 | 1.846 |
Duas leituras saem da tabela. A primeira é que o salto sobre o Sonnet 5 é grande em tarefas de agente, como terminal e uso de computador. A segunda é que o Sonnet 5.5 encosta no Opus 5.5 em quase tudo, por metade do preço por token.
Porém, a linha do FrontierCode mostra onde a diferença continua. Em problemas difíceis e abertos, o Opus mantém vantagem clara. O VentureBeat fez a mesma ressalva e lembrou que benchmark não é retrato fiel de toda carga de produção.
O que dizem os primeiros clientes
O anúncio traz depoimentos de empresas que testaram o modelo antes do lançamento. Os números são relatos dos próprios clientes, escolhidos pela Anthropic:
- Box: mais precisão, 2,4 vezes mais velocidade e 12% menos tokens no total;
- Zendesk: tickets processados 20% mais rápido;
- Slack: cerca de 14% menos tokens de saída, sem alterar os prompts;
- Lovable: um terço a menos de chamadas de ferramenta;
- Base44: em 118 aplicativos construídos, 3,6 iterações por app, contra 7,7 do Opus 5.
Repare que nenhum desses casos chega aos 30% de economia em tokens. O “até 30%” é teto, não média. Além disso, depoimento de lançamento passa por curadoria. Serve como indício, e não como garantia para a sua operação.
Quando vale migrar
A troca de modelo é barata de testar e cara de errar em produção. Por isso, o caminho é medir antes de decidir:
- Separe de 20 a 30 tarefas reais que sua operação já executa, com resultado esperado conhecido.
- Rode as mesmas tarefas nos dois modelos e registre tokens de entrada, tokens de saída, número de chamadas de ferramenta e tempo.
- Calcule o custo por tarefa concluída com sucesso. Tarefa que falha e precisa de retrabalho humano entra na conta.
- Compare também a qualidade. Economia com mais erro não é economia.
- Reavalie o que hoje roda no modelo mais caro. Parte do trabalho que exigia Opus pode caber no Sonnet 5.5.
Para quem ainda está estruturando o uso de agentes, a ordem importa. Primeiro vem o processo, depois o modelo. Tratei disso na série Operação IA, em especial no capítulo Agentes que gerenciam agentes. E, para a escolha entre fornecedores, o critério continua sendo o de Melhores IAs para empresas em 2026: a melhor IA é a que resolve o seu trabalho, no seu stack.
Perguntas frequentes
Quanto custa o Claude Sonnet 5.5?
US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída na API, o mesmo preço do Sonnet 5. A leitura de cache custa US$ 0,20 por milhão de tokens.
O Claude Sonnet 5.5 é melhor que o Opus 5.5?
Nos benchmarks publicados pela Anthropic, ele fica muito próximo do Opus 5.5 e o supera no Terminal-Bench 4.0. Em programação difícil e trabalho aberto, o Opus 5.5 continua à frente.
Por que o custo cai se o preço é o mesmo?
Porque o modelo usa menos tokens e menos chamadas de ferramenta para concluir a mesma tarefa, segundo a Anthropic. A economia divulgada é de até 30% por tarefa e varia conforme o trabalho.
Onde o Claude Sonnet 5.5 está disponível?
Na plataforma da Anthropic, com o identificador claude-sonnet-5-5, e nas nuvens da Amazon Web Services, do Google Cloud e da Microsoft Azure.

