Anthropic:Sonnet 5.5 30% mais rápido, 30% mais barato vs 5
Claude Sonnet 5.5 chega com ganhos práticos de velocidade e custo, mantendo 1M de contexto e entregando eficiência real em coding e trabalho de conhecimento, pronto em AWS e outras nuvens
Danilo Gato
Autor
Introdução
Claude Sonnet 5.5 é, de fato, 30% mais rápido e até 30% mais barato por tarefa do que o Sonnet 5, mantendo o foco em tarefas do dia a dia, correção de bugs e produção de documentos polidos. A Anthropic divulgou o lançamento em 28 de setembro de 2026, com detalhes de performance, preço e salvaguardas. (anthropic.com)
A palavra chave aqui é eficiência. O Claude Sonnet 5.5 preserva o contexto de 1M de tokens, oferece até 128k tokens de saída por chamada e pode chegar a 300k tokens de saída via Batch API em beta. Isso combinado com um preço de 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de saída cria uma faixa clara de custo-benefício para cargas de trabalho intensivas em texto e imagem. (platform.claude.com)
O que realmente mudou no Claude Sonnet 5.5
A Anthropic posiciona o Sonnet 5.5 como um salto claro sobre o Sonnet 5, não apenas em velocidade, mas também na quantidade de tokens que o modelo precisa para fechar tarefas, o que se traduz em contas menores. Segundo a empresa, os ganhos típicos chegam a 30% de redução no custo por tarefa, mantendo a qualidade, com geração de respostas 30% mais rápida. (anthropic.com)
Em benchmarks internos citados pela Anthropic, o Sonnet 5.5 marcou 70,6% no Terminal-Bench 4.0, um teste de agente para coding, e ficou a poucos pontos do Opus 5.5 no GDPval-AA, que avalia trabalhos reais em dezenas de ocupações. O modelo também avança em entendimento visual, inclusive com progresso em jogos clássicos operando a partir de screenshots, um indicativo de coordenação passo a passo mais robusta. (anthropic.com)
No uso colaborativo, o 5.5 é descrito como mais claro na escrita e mais rápido para iterar em tarefas menos complexas. Depoimentos de parceiros citados no anúncio apontam para menos etapas de tool use, menos tokens, execução mais rápida e taxas de conclusão elevadas em pipelines reais. Embora o Opus 5.5 permaneça superior em trabalhos abertos e de alto julgamento, o Sonnet 5.5 encurta em várias frentes o gap de custo, tempo e iterações. (anthropic.com)
Preço, contexto e latência na prática
Para quem gerencia orçamento de LLM, os preços oficiais do Sonnet 5.5 são diretos: 2 dólares por milhão de tokens de entrada, 10 dólares por milhão de tokens de saída, com cache read a 0,20 dólar por milhão e cache write a 2,50 ou 4 dólares conforme TTL. A janela de contexto é de 1M de tokens e a saída máxima é 128k por chamada, com suporte a 300k no Batch API beta. A documentação também destaca “adaptive thinking” ativado por padrão e esforço padrão em high, o que equilibra custo, qualidade e latência. (platform.claude.com)
O anúncio público reforça que o ganho de custo não vem de uma tabela de preço menor do que no Sonnet 5, e sim da eficiência do 5.5 em usar bem menos tokens para cumprir o mesmo trabalho. Em outras palavras, a conta final tende a cair sem que seja preciso reescrever tudo. Em workloads repetitivos, extração e revisão, esse efeito prático é visível. (anthropic.com)
Disponibilidade, nuvem e governança
O Claude Sonnet 5.5 está disponível em múltiplas plataformas, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. A Anthropic confirma disponibilidade ampla, além de zero data retention como opção. Para quem padroniza em AWS, o modelo está no Amazon Bedrock com lançamento datado de 28 de setembro de 2026, incluindo detalhes de endpoints, suporte a computer use e perfis de inferência. (anthropic.com)
No Bedrock, a ficha técnica lista contexto de 1M, 128k de saída, cutoff de conhecimento em junho de 2026, esforço configurável e recursos como streaming, prompt caching e guardrails. Há nuances de residência de dados e perfis de inferência globais e regionais. Para equipes com requisitos de conformidade, vale checar a tabela de disponibilidade por região e preferir endpoints que mantenham dados in-region quando necessário. (docs.aws.amazon.com)
Casos de uso que ganham com o 5.5
- Coding e manutenção de bases existentes. Early testers e parceiros reportaram que o Sonnet 5.5 entende bases de código rapidamente, agrupa chamadas de ferramentas e reduz etapas, o que acelera implementação e revisão de features, além de diminuir tokens por tarefa. Para ciclo de build em IDEs com agentes, essa redução de idas e vindas corta espera e custo. (anthropic.com)
- Documentos e conteúdo executivo. O 5.5 produz materiais prontos para uso, como one-pagers, sumários e slides, com escrita mais clara, o que ajuda times de produto, vendas e suporte. Em avaliações internas e externas citadas, o tempo de resolução de tíquetes e a taxa de acerto em rotinas de suporte melhoraram, com menos saídas equivocadas. (anthropic.com)
- Análises e extração em lotes. Com Batch API oferecendo desconto de 50% em input e output e saída de até 300k tokens em beta, pipelines de ETL semântica e data labeling assistido tornam-se mais previsíveis, especialmente quando a latência não é crítica. (platform.claude.com)
- Conhecimento com long-horizon. O 5.5 melhora em tarefas que exigem planejamento de múltiplos passos, inclusive com reconhecimento de gráficos e telas. Isso favorece fluxos com verificação incremental, QA de documentos extensos e procedimentos guiados. (anthropic.com)
Benchmarks e sinais de qualidade

Os números oficiais ajudam a calibrar expectativas. O Terminal-Bench 4.0 em 70,6% indica alta competência em coding agentic. No GDPval-AA, o Sonnet 5.5 fica próximo do Opus 5.5, que ainda é a referência da casa para trabalhos abertos de alto julgamento. Em long-horizon e visão, o 5.5 supera o Sonnet 5 com folga. É prudente tratar leaderboard externo como complementar, já que cenários, seeds e tool use mudam muito de ambiente para ambiente. (anthropic.com)
Equipes que já compararam Sonnet 5 e Opus 5.x em custo por tarefa notam que preço por token não conta a história toda. Eficiência na quantidade de passos, chamadas de ferramenta e tokens é determinante para o TCO real. A Anthropic tenta endereçar isso ao enfatizar batching de tool use, escrita mais objetiva e menor verbosidade do 5.5. Em ambientes de produção, é recomendável mensurar “custo por ticket resolvido” em vez de só preço por milhão de tokens. (anthropic.com)
Segurança, salvaguardas e conformidade
A Anthropic afirma que o Sonnet 5.5 iguala ou melhora o Sonnet 5 na maioria das medidas de alinhamento do seu auditoria automatizada. O modelo herda ou se aproxima das proteções de cibersegurança do Opus 5, com fallbacks visíveis para tarefas de maior risco, e mantém a mesma política de salvaguardas em biologia do Sonnet 5. Também há mecanismos contra extração de raciocínio e preservação de thinking por conta, para reduzir risco de distilação hostil. Para setores regulados, essa camada de salvaguardas somada a opções de residência de dados em nuvem é um diferencial prático. (anthropic.com)
No Bedrock, recursos como guardrails e knowledge bases podem ser combinados com o Sonnet 5.5 para impor políticas e contenções organizacionais. Isso facilita auditoria, observabilidade e o cumprimento de normas, com a vantagem de billing unificado e perfis de inferência que respeitam requisitos geográficos quando aplicável. (docs.aws.amazon.com)
Migração do Sonnet 5 para o 5.5, atenção aos breaking changes
A documentação oficial lista mudanças incompatíveis que podem afetar integrações existentes. Entre elas, a necessidade de adotar o novo modo between_tools se o objetivo for manter o “thinking” inicial desligado, alterações no comportamento de tool forcing, e a vinculação de thinking blocks ao modelo e à conversa. Há também mudanças no suporte a versões antigas do computer use tool em determinados provedores e ajustes no Advisor. Vale revisar o guia de migração e validar testes end-to-end antes do switch em produção. (platform.claude.com)
Outro ponto que impacta UX é a forma de streaming entre tool calls. O texto “entre ferramentas” agora aparece em thinking blocks, o que pode silenciar o streaming para o usuário até que o aplicativo defina um display apropriado ou desligue o thinking inicial via between_tools. É um detalhe técnico, mas que muda percepção de responsividade e, portanto, a experiência do usuário final. (platform.claude.com)
Playbook prático para adotar o Sonnet 5.5
- Medir custo por tarefa, não só preço por token. Crie um harness simples com 20 a 50 tarefas representativas do seu domínio, incluindo as com long-horizon e as puramente mecânicas. Compare tempo total, passos de tool use, tokens e taxa de acerto. O objetivo é confirmar o ganho de 30% em velocidade e a economia por tarefa anunciados, no seu contexto. (anthropic.com)
- Ajustar “effort” e thinking de acordo com o objetivo. Para respostas rápidas em rotinas, effort baixo ou médio costuma bastar. Para trabalhos que exigem checagem rigorosa, effort alto ou máximo pode compensar pela qualidade, mesmo com mais tokens. (anthropic.com)
- Usar Batch API para jobs volumosos. Quando a latência não é crítica, o desconto de 50% e a saída estendida a 300k tokens ajudam a consolidar resultados longos em uma chamada, reduzindo fragmentação e risco de inconsistência. (platform.claude.com)
- Integrar via AWS quando governança é prioridade. O Bedrock adiciona guardrails, knowledge bases e opções de residência, com documentação clara de endpoints e perfis globais e regionais. Para quem já está em AWS, a adoção tende a ser plug-and-play do ponto de vista operacional. (docs.aws.amazon.com)
Reflexões e insights
Modelos intermediários que entregam próximo de “frontier” em custo menor tendem a acelerar ciclos de produto. O Claude Sonnet 5.5 ocupa esse espaço: rápido, menos verborrágico, bom em ferramentas e com escrita mais direta. Em coding, a redução de passos e tokens movimenta não só a fatura, mas também o throughput do time. Em suporte e backoffice, menos erros e mais velocidade cortam filas e tempo de espera, que é o KPI que realmente aparece para o usuário. (anthropic.com)
Outro aprendizado prático é separar “capacidade” de “governança”. O 5.5 chega junto de uma malha de salvaguardas, cache e ferramentas de plataforma. Essa composição é o que viabiliza adoção ampla no enterprise, especialmente quando residencia de dados, logs e controles são mandatórios. O que importa não é só marcar 70,6% em um benchmark, e sim encadear passos com menos fricção operacional, previsibilidade de custo e qualidade mensurável. (anthropic.com)
Conclusão
Claude Sonnet 5.5 entrega o que muita equipe pedia, velocidade, economia por tarefa e menos passos para chegar ao mesmo resultado, sem exigir uma reescrita total de pipelines. Com 1M de contexto, 128k de saída, Batch mais barato e disponibilidade em AWS, a peça se encaixa bem em coding, suporte e workflows de conhecimento. (anthropic.com)
O movimento reforça a tendência de que eficiência real, em tokens e passos, pesa mais do que preço por milhão isolado. Para capturar o valor, vale medir custo por tarefa, calibrar effort e explorar Batch e guardrails. Quem fizer isso tende a sentir, na prática, os prometidos 30% de ganho de velocidade e economia. (anthropic.com)
Leia também
Google troca Gems do Gemini por Skills em novembro de 2026
O Google vai substituir os Gems do Gemini por Skills a partir de 17 de novembro de 2026. A transição, já visível em avisos no app, muda como agentes personalizados funcionam, impacta quem usa Spark e pode exigir assinatura. Entenda prazos, o que muda e como se preparar com passos práticos e checklists.
10 min de leituraInteligência ArtificialStability AI lança plugin DAW do Stable Audio 3.0 e app beta
O Stable Audio 3.0 ganhou um plugin nativo para DAWs e um app web mais robusto, ambos em beta. Agora dá para gerar música alinhada ao BPM do projeto, escolher a duração exata, salvar takes, iterar por texto e áudio, editar por faixa e exportar. Com modelos treinados em dados licenciados e pesos abertos para Small e Medium, o pacote combina segurança comercial e flexibilidade para fluxos modernos de produção musical.
9 min de leituraInteligência ArtificialOpenAI Academy expande trilhas IA para devs líderes e alunos
A OpenAI expandiu a OpenAI Academy com trilhas para desenvolvedores, líderes, educadores e estudantes. O foco é aprender IA na prática, com cursos alinhados ao trabalho real, avaliações e badges para comprovar habilidades. Veja o que muda, oportunidades e como aplicar.
8 min de leituraIA em SaúdeOpenAI lança MentalHealthBench, benchmark 80+ especialistas
A OpenAI apresentou o MentalHealthBench, um benchmark aberto construído com 80+ especialistas em saúde mental para avaliar como modelos de IA respondem a conversas realistas, de bem estar cotidiano a emergências. Entenda a metodologia, os dados, onde a IA acerta e onde ainda precisa evoluir, e como usar esse padrão para projetar produtos mais seguros e úteis no cuidado em saúde mental.
10 min de leitura