IA e Mercado
Claude Sonnet 5.5 chegou: o preço de tabela não mudou, mas a conta por tarefa caiu
Por Albert Rodrigues, Sócio e CEO da Zera Company · 28 de setembro de 2026 · 12 min de leitura
Em 28 de setembro de 2026, a Anthropic lançou o Claude Sonnet 5.5, o novo modelo intermediário da família Claude. Chegou seis dias depois do Opus 5.5 e menos de três meses depois do Sonnet 5, que acabou de virar legado.
A manchete que vai circular é “30% mais barato e 30% mais rápido”. As duas metades estão certas, mas cada uma tem um detalhe que muda a conta de quem usa IA no negócio. O preço por token não caiu nem um centavo. E o “mais rápido” mede outra coisa do que o dono de empresa imagina. Entender esses dois detalhes vale mais do que decorar a tabela de testes.
Resumo em 40 segundos. O Claude Sonnet 5.5 saiu em 28 de setembro de 2026 pelo mesmo preço por token do Sonnet 5: US$ 2 por milhão de tokens de entrada e US$ 10 de saída. A economia vem de ele usar menos tokens para o mesmo trabalho: nos testes da Anthropic, custa até 30% menos por tarefa e gera respostas mais de 30% mais rápido. Em vários testes, chega perto do Opus 5.5, que custa o dobro, mas a própria Anthropic diz que o Opus segue claramente mais forte em trabalho complexo. O ganho grande está no esforço baixo e no médio. Para empresas: escolha o modelo e o esforço por tarefa, meça custo por tarefa concluída e não amarre a operação a uma versão.
Sumário
- O que a Anthropic lançou
- Preço igual, conta menor: como isso fecha
- Os números, com o rodapé que a manchete não traz
- Onde o Sonnet 5.5 não substitui o Opus 5.5
- O que isso impacta no seu negócio
- A visão da Zera
1. O que a Anthropic lançou
O Sonnet 5.5 é o segundo modelo da família Claude 5.5, depois do Opus 5.5, lançado em 22 de setembro. A Anthropic o posiciona como o complemento mais rápido e mais barato do Opus: enquanto o Opus 5.5 é feito para trabalho complexo que exige julgamento cuidadoso, o Sonnet 5.5 é mais forte em tarefas do dia a dia bem delimitadas, correção de bugs e criação de documentos, slides e planilhas bem acabados. O terceiro membro da família, o Haiku 5.5, voltado para aplicações de alto volume e sensíveis a custo, vem “nas próximas semanas”, segundo a empresa.
O modelo já está disponível na API da Claude para todos os clientes, com o identificador claude-sonnet-5-5, e também no Amazon Bedrock, na Claude Platform on AWS, no Google Cloud e no Microsoft Foundry. No Claude Code e nos apps da Claude, ele roda com esforço médio como padrão; na API, o padrão é o esforço alto. A janela de contexto de 1 milhão de tokens e a saída máxima de 128 mil tokens são as mesmas do Sonnet 5, assim como a opção de retenção zero de dados, que importa para quem opera sob a LGPD.
A divisão de trabalho que a própria Anthropic sugere fica assim:
| Modelo | Para que a Anthropic indica | Preço por milhão de tokens (entrada / saída) |
|---|---|---|
| Opus 5.5 | Trabalho complexo que exige julgamento cuidadoso | US$ 4 / US$ 20 |
| Sonnet 5.5 | Tarefas do dia a dia bem delimitadas, correção de bugs, documentos, slides e planilhas | US$ 2 / US$ 10 |
| Haiku 5.5 | Aplicações de alto volume e sensíveis a custo | Ainda não lançado (previsto para as próximas semanas) |
Fonte: anúncios do Sonnet 5.5 (28/09/2026) e do Opus 5.5 (22/09/2026), publicados pela Anthropic.
2. Preço igual, conta menor: como isso fecha
Esta é a parte que a manchete “30% mais barato” esconde. A tabela de preço do Sonnet 5.5 é idêntica à do Sonnet 5, linha por linha:
| Por milhão de tokens | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Entrada | US$ 2 | US$ 2 | US$ 4 |
| Saída | US$ 10 | US$ 10 | US$ 20 |
| Leitura de cache | US$ 0,20 | US$ 0,20 | US$ 0,20 |
| Escrita de cache (5 minutos) | US$ 2,50 | US$ 2,50 | US$ 5 |
Fonte: anúncio do Sonnet 5.5 e página de preços da documentação da Anthropic, consultados em 28/09/2026. A escrita de cache de 1 hora custa US$ 4 no Sonnet 5.5 e US$ 8 no Opus 5.5. No processamento em lote, o Sonnet 5.5 sai pela metade: US$ 1 de entrada e US$ 5 de saída.
Se o preço é o mesmo, de onde sai a economia? Do tanto de tokens que o modelo gasta para chegar ao resultado. Nas palavras da Anthropic, o Sonnet 5.5 “costuma precisar de bem menos tokens para fazer o mesmo trabalho” e, nos testes da empresa, custa até 30% menos por tarefa que o antecessor. É a mesma lógica que analisamos quando o Opus 5 chegou: parar de medir preço de token e passar a medir custo por tarefa concluída. Dessa vez, a economia não depende de nenhum recurso novo: vem do modelo trabalhando de forma mais enxuta.
Um relato de cliente publicado no anúncio mostra o tamanho que isso pode ter. A gestora Balyasny Asset Management rodou 2.441 tarefas de finanças, entre perguntas, extração, análise e previsão: o Sonnet 5.5 pontuou acima do Sonnet 5 usando cerca de 121 mil tokens por resposta, contra 497 mil do antecessor. É um caso de uma empresa, na carga dela, e não uma média. Mas mostra por que olhar só o preço de tabela engana.
Uma nota sobre o Sonnet 5, para quem acompanhou o nosso post do lançamento: o preço de US$ 2 e US$ 10 tinha sido anunciado como introdutório, com aumento para US$ 3 e US$ 15 marcado para 1º de setembro. Em 10 de agosto de 2026, a Anthropic tornou o preço introdutório permanente, e o aumento não aconteceu. O Sonnet 5.5 herdou esse preço.
E o “30% mais rápido”? A frase exata da Anthropic é que o Sonnet 5.5 “gera saídas mais de 30% mais rápido que o Sonnet 5”, o que o torna o Sonnet mais rápido que a empresa já lançou. A métrica é a velocidade de geração do texto. Isso não significa que toda tarefa termina 30% antes, porque o tempo total também depende de quantos passos o modelo dá e de quantas ferramentas ele chama. Na prática, as duas coisas somam a favor: menos passos e escrita mais rápida.
3. Os números, com o rodapé que a manchete não traz
Estes são os resultados publicados pela Anthropic, lado a lado com o antecessor, com o Opus 5.5 e com o GPT-6 Sol, da OpenAI:
| Teste (o que mede) | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 (tarefas de programação em terminal) | 70,6% | 10,3% | 66,4% (esforço Xhigh) | não informado |
| FrontierCode 1.1 (mudança de código aceita sem edição humana) | 52,1% (Xhigh); 46,2% (Max) | 42,4% | 54,4% | 49,3% |
| CursorBench 4.0 (sessões reais de programação no Cursor) | 55,5% | 34,1% | 57,8% | não informado |
| OSWorld 2.1 (uso de computador) | 80,1% | 57,0% | 81,8% | não informado |
| GDPval-AA v2.1 (trabalho real em 44 profissões, em pontos) | 1.844 | 1.449 | 1.846 | 1.487 |
| Humanity’s Last Exam, com ferramentas (raciocínio em várias áreas) | 64,5% | 54,9% | 67,7% | não informado |
Fonte: anúncio do Claude Sonnet 5.5, Anthropic, 28/09/2026. Os números são da própria Anthropic ou de avaliadores citados por ela, e a metodologia completa está no System Card do modelo.
O salto é real, mas quatro ressalvas, três do próprio rodapé do anúncio e uma da imprensa técnica, mudam a leitura:
- O pulo de 10% para 70% no Terminal-Bench não mede só inteligência. Segundo o The New Stack, os mantenedores do teste disseram que o Sonnet 5 às vezes esbarrou em limite de tempo e de tokens, o que ajuda a explicar a nota tão baixa do antecessor.
- O GDPval-AA foi rodado numa versão de pré-lançamento. A Artificial Analysis testou uma versão do Sonnet 5.5 que tinha um bug, já corrigido, que podia piorar respostas com saídas estruturadas.
- A nota do GPT-6 Sol no GDPval-AA pode estar desatualizada. A própria Anthropic avisa que a OpenAI corrigiu um bug de leitura de imagem no modelo e que algumas notas de terceiros talvez ainda não reflitam a versão mais recente, embora a Artificial Analysis não espere impacto grande no GDPval-AA.
- No FrontierCode, mais esforço deu nota menor. No esforço Max, o Sonnet 5.5 acionou com mais frequência a revisão de código dividida entre vários subagentes, o que, em dois casos examinados pela Cognition, levou a estouro de tempo ou a edições fora do escopo pedido. Esforço máximo não é sinônimo de resultado máximo.
Há ainda um número que interessa mais ao bolso do que ao placar: em vários testes, o Sonnet 5.5 no esforço baixo ou médio supera a melhor nota do Sonnet 5 gastando cerca de um décimo do custo por tarefa. Vale para esses testes, não como média de uso, mas aponta onde a economia mora.
4. Onde o Sonnet 5.5 não substitui o Opus 5.5
Aqui vai o contraponto que o discurso de lançamento traz em letra miúda. O Sonnet 5.5 passa o Opus 5.5 em um único teste da tabela, o Terminal-Bench. Nos outros, fica abaixo, às vezes por muito pouco. E a própria Anthropic escreve que, nos testes dela e nos de avaliadores externos, o Opus 5.5 continua claramente mais forte em trabalho complexo e aberto, que exige julgamento sustentado. A empresa vai além e diz, na seção de segurança, que o Sonnet 5.5 não avança a fronteira de capacidade dos seus modelos.
Tem um segundo detalhe, ainda menos comentado. A Anthropic afirma que o Sonnet 5.5 complementa melhor o Opus quando roda em esforço mais baixo, onde custa menos por tarefa. Nos esforços mais altos, ele pode ter desempenho comparável ao do Opus, mas a um custo parecido. Ou seja: quem liga o Sonnet 5.5 no máximo em tudo provavelmente perde a economia que motivou a troca.
Um dos testadores citados no anúncio, falando do desenvolvimento de um jogo, resumiu a divisão que faz sentido: com o Opus 5.5 definindo a arquitetura, ele confiaria no Sonnet 5.5 para implementar. Modelo caro para decidir, modelo mais barato para executar. E mesmo quem elogiou foi com calma: a CodeRabbit, de revisão de código, disse que planeja mover agora as revisões simples e moderadas para o Sonnet 5.5, e mais “nas próximas semanas”.
5. O que isso impacta no seu negócio
Traduzindo o lançamento para a mesa do gestor:
- A economia existe, mas não chega sozinha. O “até 30% por tarefa” foi medido pela Anthropic, na carga dela. Na sua operação, o número pode ser maior, menor ou nenhum. A única forma de saber é rodar a sua tarefa real nos dois modelos e comparar o custo por tarefa concluída, contando as revisões humanas.
- Esforço virou linha de orçamento. Com os níveis de esforço, dá para rodar atendimento padronizado, classificação de mensagens e rascunhos em esforço baixo e reservar o esforço alto, ou o Opus, para o que vai para a mão do cliente. Atenção: a Anthropic recalibrou os níveis, e o médio do Sonnet 5.5 não pensa o mesmo tanto que o médio do Sonnet 5. Configuração copiada do modelo anterior precisa ser testada de novo.
- Trocar de modelo não é trocar um nome. A documentação da Anthropic lista cinco mudanças que quebram código feito para o Sonnet 5, entre elas o fim do uso forçado de ferramenta, que agora retorna erro, e um ajuste novo obrigatório para quem roda o modelo com o raciocínio desligado. Quem tem automação rodando em produção precisa de teste antes da virada, não depois.
- O modelo da vez envelhece rápido. O Sonnet 5 saiu em 30 de junho e virou legado em 28 de setembro, 90 dias depois. Ele continua disponível até pelo menos 30 de junho de 2027, então ninguém precisa correr. Mas a operação que depende de uma versão específica vai refazer integração a cada poucos meses.
6. A visão da Zera
O Sonnet 5.5 é uma boa notícia para quem usa IA em escala, e pelo motivo menos chamativo: ele deixa o trabalho rotineiro mais barato sem mexer no preço de tabela. Só que essa economia não aparece para quem compara modelos pela manchete. Aparece para quem sabe quanto custa cada tarefa da própria operação e escolhe, tarefa a tarefa, qual modelo e qual esforço usar.
A pergunta certa continua a mesma de todo lançamento: quando este modelo for substituído, e o antecessor dele durou 90 dias como o mais novo da linha, o que da sua operação continua de pé? Quem constrói com maturidade separa a inteligência do negócio, que é a lógica de qualificação, os processos e os dados que só a sua empresa tem, da ferramenta do momento, que fica mais barata e mais trocável a cada mês. É assim que montamos automação e marketing com IA na Zera: com a lógica do cliente no centro e o modelo como peça que se troca sem derrubar o que faz a empresa vender.
Se você usa ou pretende usar IA em algo que não pode parar, seja atendimento, marketing, automação ou dados, peça um diagnóstico. Avaliamos onde a sua operação está exposta e como deixá-la à prova de troca de modelo.
Para o contexto, veja a nossa análise de quando o Opus 5 mudou a corrida da IA para custo por tarefa e de quando o Fable 5 voltou e o Sonnet 5 chegou. Conheça também os nossos serviços.
Perguntas frequentes
- O que é o Claude Sonnet 5.5?
- É o novo modelo intermediário da Anthropic, lançado em 28 de setembro de 2026 com o identificador claude-sonnet-5-5. É o segundo modelo da família Claude 5.5, seis dias depois do Opus 5.5. A Anthropic o apresenta como um complemento mais rápido e mais barato do Opus 5.5, mais forte em tarefas do dia a dia bem delimitadas, correção de bugs e criação de documentos, slides e planilhas. O Haiku 5.5, voltado para alto volume, vem nas próximas semanas.
- O Sonnet 5.5 ficou mais barato que o Sonnet 5?
- Por token, não. O preço é idêntico ao do Sonnet 5: 2 dólares por milhão de tokens de entrada, 10 por milhão de saída e 0,20 por milhão em leitura de cache. O que caiu foi o custo por tarefa: segundo a Anthropic, o modelo costuma precisar de bem menos tokens para fazer o mesmo trabalho e, nos testes da empresa, custa até 30% menos por tarefa que o Sonnet 5. É um "até", medido pela própria fabricante, e não um desconto garantido na sua fatura.
- O Sonnet 5.5 é melhor que o Opus 5.5?
- Não no geral. Ele passa o Opus 5.5 em um teste de programação em terminal (70,6% contra 66,4% no Terminal-Bench 4.0) e fica perto dele em outros, como o GDPval-AA, de trabalho real em 44 profissões (1.844 contra 1.846 pontos). Mas a própria Anthropic afirma que o Opus 5.5 continua claramente mais forte em trabalho complexo e aberto, que exige julgamento sustentado, e diz que o Sonnet 5.5 não avança a fronteira de capacidade dos seus modelos.
- Quanto mais rápido o Sonnet 5.5 é?
- Segundo a Anthropic, ele gera as respostas mais de 30% mais rápido que o Sonnet 5 e é o Sonnet mais rápido que a empresa já lançou. A métrica é a velocidade de geração do texto de saída. Isso não quer dizer que toda tarefa termina 30% antes, porque o tempo total depende também de quantos passos o modelo dá e de quantas ferramentas ele chama.
- Quem usa o Sonnet 5 precisa migrar agora?
- Não com pressa. O Sonnet 5 continua disponível, agora marcado como legado, com retirada prevista para não antes de 30 de junho de 2027. A Anthropic recomenda migrar, mas a troca não é só mudar o nome do modelo: a documentação lista cinco mudanças que quebram código feito para o Sonnet 5, e os níveis de esforço foram recalibrados. O caminho seguro é testar a sua carga real nos dois modelos e comparar o custo por tarefa concluída antes de virar a chave.
- O que o Sonnet 5.5 muda para uma empresa?
- Deixa mais barata a execução do trabalho rotineiro de IA, desde que o esforço seja ajustado. O ganho grande aparece no esforço baixo e no médio; no alto, a própria Anthropic diz que ele pode ter desempenho comparável ao Opus 5.5 a um custo parecido. Para o negócio, a lição é escolher o modelo e o esforço por tipo de tarefa, medir custo por tarefa concluída e não amarrar a operação a uma versão: o Sonnet 5 virou legado 90 dias depois de lançado.
Albert Rodrigues
Sócio e CEO da Zera Company
Quer marketing que vira faturamento?
Quero meu diagnósticoContinue lendo
IA e Mercado
WhatsApp em 1 de outubro: você passa a pagar para responder, e ganha 1.000 mensagens por mês
Em 1 de outubro de 2026 a Meta passa a cobrar pelas mensagens de serviço e pelas de utilidade enviadas dentro da janela de 24 horas, com uma franquia nova de 1.000 mensagens grátis por mês por número. Sem forma de pagamento cadastrada até 30 de setembro, o que passar da franquia deixa de ser entregue. Veja a tabela, os prazos e por onde isso vira margem.
IA e Mercado
O novo custo do WhatsApp em 2026: o que mudou, o que muda em outubro e por que o atendimento precisa sair do celular de uma pessoa
O WhatsApp mudou como cobra em 2026 e vai mudar de novo em outubro. Veja quanto custa cada categoria de mensagem no Brasil, o que acontece quando a janela grátis fechar e por que uma caixa de entrada compartilhada protege o seu custo e as suas vendas.