Claude Sonnet 5.5: mesmo preço, tarefa até 30% mais barata

O Claude Sonnet 5.5 mantém o preço por token e promete custo até 30% menor por tarefa. Entenda a conta, os benchmarks e quando vale migrar.

Quim PierottoQuim Pierotto30/09/2026
Claude Sonnet 5.5: mesmo preço, tarefa até 30% mais barata

Imagem criada por inteligência artificial

A Anthropic lançou o Claude Sonnet 5.5 na segunda-feira, 28 de setembro, com uma promessa que parece contraditória. O preço por token é o mesmo do Sonnet 5, e o custo de concluir uma tarefa cai até 30%. A explicação está na unidade de medida. Quem opera agentes de IA não paga por token, paga por trabalho entregue. Se o modelo resolve o mesmo problema com menos tokens e menos chamadas de ferramenta, a fatura cai sem que a tabela mude. Essa é a métrica que uma empresa deveria acompanhar, e o lançamento é um bom motivo para começar.

Resumo: o Claude Sonnet 5.5 custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída, igual ao Sonnet 5. A Anthropic afirma que ele gera saída mais de 30% mais rápido e reduz o custo por tarefa em até 30%, porque usa menos tokens e menos chamadas de ferramenta. Nos benchmarks divulgados pela empresa, fica muito perto do Opus 5.5 por metade do preço por token. São números do fabricante e de clientes selecionados. A decisão de migrar deve sair de um teste com as tarefas da própria operação, medindo custo por tarefa concluída.

Neste artigo

O que foi lançado

O Sonnet é o modelo intermediário da família Claude, abaixo do Opus. Segundo o anúncio da Anthropic, a versão 5.5 está disponível na plataforma da empresa com o identificador claude-sonnet-5-5, além de Amazon Web Services, Google Cloud e Microsoft Azure.

Os preços seguem os do Sonnet 5: US$ 2 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,20 por milhão de tokens lidos do cache. De acordo com a cobertura do MarkTechPost, a janela de contexto é de 1 milhão de tokens, com saída máxima de 128 mil.

Há também uma novidade de segurança. É o primeiro Sonnet com salvaguardas de cibersegurança e com classificadores que bloqueiam tentativas de extrair o raciocínio do modelo, prática usada para copiar capacidades de um modelo para outro.

Por que o custo por tarefa cai se o preço não mudou

Um agente de IA não responde uma pergunta e para. Ele lê arquivos, chama ferramentas, confere o resultado e tenta de novo. Cada passo consome tokens, e cada chamada de ferramenta devolve ao modelo mais texto para processar. Por isso, a fatura de uma tarefa depende de três fatores:

  • Preço por token, que está na tabela;
  • Tokens consumidos, que dependem de quanto o modelo escreve e relê;
  • Número de passos, que depende de quantas tentativas ele precisa.

A Anthropic manteve o primeiro fator e afirma ter reduzido os outros dois. Segundo o VentureBeat, a empresa atribui a economia a menos tokens, menos chamadas de ferramenta e geração mais rápida.

Um exemplo hipotético ajuda. Imagine uma tarefa que consumia 400 mil tokens de entrada e 40 mil de saída. Pela tabela, ela custava US$ 1,20. Se o modelo novo resolve a mesma tarefa com 30% menos tokens, o custo cai para US$ 0,84. O preço não mudou, e a conta ficou menor. Os números são ilustrativos. O valor real depende da tarefa.

Esse raciocínio vale para qualquer fornecedor. Em Jev: a IA 400x mais barata que o ChatGPT, mostrei o outro lado da moeda: preço baixo por token não serve de nada quando o modelo não entrega o trabalho.

O que os benchmarks mostram

A Anthropic publicou os resultados abaixo. São números do fabricante e devem ser lidos como tal.

BenchmarkSonnet 5Sonnet 5.5Opus 5.5
Terminal-Bench 4.0 (tarefas em terminal)10,3%70,6%66,4%
OSWorld 2.1 (uso de computador)57,0%80,1%81,8%
CursorBench 4.0 (programação)34,1%55,5%57,8%
FrontierCode 1.1 (programação difícil)42,4%46,2%54,4%
GDPval-AA v2.1 (trabalho de conhecimento)1.4491.8441.846

Duas leituras saem da tabela. A primeira é que o salto sobre o Sonnet 5 é grande em tarefas de agente, como terminal e uso de computador. A segunda é que o Sonnet 5.5 encosta no Opus 5.5 em quase tudo, por metade do preço por token.

Porém, a linha do FrontierCode mostra onde a diferença continua. Em problemas difíceis e abertos, o Opus mantém vantagem clara. O VentureBeat fez a mesma ressalva e lembrou que benchmark não é retrato fiel de toda carga de produção.

O que dizem os primeiros clientes

O anúncio traz depoimentos de empresas que testaram o modelo antes do lançamento. Os números são relatos dos próprios clientes, escolhidos pela Anthropic:

  • Box: mais precisão, 2,4 vezes mais velocidade e 12% menos tokens no total;
  • Zendesk: tickets processados 20% mais rápido;
  • Slack: cerca de 14% menos tokens de saída, sem alterar os prompts;
  • Lovable: um terço a menos de chamadas de ferramenta;
  • Base44: em 118 aplicativos construídos, 3,6 iterações por app, contra 7,7 do Opus 5.

Repare que nenhum desses casos chega aos 30% de economia em tokens. O “até 30%” é teto, não média. Além disso, depoimento de lançamento passa por curadoria. Serve como indício, e não como garantia para a sua operação.

Quando vale migrar

A troca de modelo é barata de testar e cara de errar em produção. Por isso, o caminho é medir antes de decidir:

  • Separe de 20 a 30 tarefas reais que sua operação já executa, com resultado esperado conhecido.
  • Rode as mesmas tarefas nos dois modelos e registre tokens de entrada, tokens de saída, número de chamadas de ferramenta e tempo.
  • Calcule o custo por tarefa concluída com sucesso. Tarefa que falha e precisa de retrabalho humano entra na conta.
  • Compare também a qualidade. Economia com mais erro não é economia.
  • Reavalie o que hoje roda no modelo mais caro. Parte do trabalho que exigia Opus pode caber no Sonnet 5.5.

Para quem ainda está estruturando o uso de agentes, a ordem importa. Primeiro vem o processo, depois o modelo. Tratei disso na série Operação IA, em especial no capítulo Agentes que gerenciam agentes. E, para a escolha entre fornecedores, o critério continua sendo o de Melhores IAs para empresas em 2026: a melhor IA é a que resolve o seu trabalho, no seu stack.

Perguntas frequentes

Quanto custa o Claude Sonnet 5.5?

US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída na API, o mesmo preço do Sonnet 5. A leitura de cache custa US$ 0,20 por milhão de tokens.

O Claude Sonnet 5.5 é melhor que o Opus 5.5?

Nos benchmarks publicados pela Anthropic, ele fica muito próximo do Opus 5.5 e o supera no Terminal-Bench 4.0. Em programação difícil e trabalho aberto, o Opus 5.5 continua à frente.

Por que o custo cai se o preço é o mesmo?

Porque o modelo usa menos tokens e menos chamadas de ferramenta para concluir a mesma tarefa, segundo a Anthropic. A economia divulgada é de até 30% por tarefa e varia conforme o trabalho.

Onde o Claude Sonnet 5.5 está disponível?

Na plataforma da Anthropic, com o identificador claude-sonnet-5-5, e nas nuvens da Amazon Web Services, do Google Cloud e da Microsoft Azure.

Referências

Quim Pierotto
Transforma tecnologia, estratégia digital e inovação em resultados.
Artigos criados 316

Artigos relacionados

Digite acima o seu termo de pesquisa e prima Enter para pesquisar. Prima ESC para cancelar.

Voltar ao topo

Operado por Spreable