Produto · 2 de outubro de 2026

Também publicado em Français, Deutsch, Italiano

Anthropic lança Claude Sonnet 5.5 com melhorias em codificação e análise de imagens

Designer sketching eyeglasses with laptop and tools
Vooglam Eyewear / Unsplash

A Anthropic lançou o Claude Sonnet 5.5, o segundo modelo da família Claude 5.5, após o Opus 5.5. O novo modelo é posicionado como uma alternativa mais rápida e barata que o Opus 5.5, sendo destinado a tarefas diárias com escopo definido, correção de erros e criação de documentos, apresentações e planilhas.

O Techsauce informou que o modelo opera com velocidade superior em 30% e apresenta uma redução de custo por tarefa de até 30% na maioria dos trabalhos em comparação com o Sonnet 5. Os preços por token permanecem os mesmos da versão anterior: 2 dólares por 1 milhão de tokens de entrada, 10 dólares por 1 milhão de tokens de saída, 0,20 dólares para leituras de cache e 2,50 dólares para gravações de cache.

Em termos de desempenho, o Sonnet 5.5 demonstrou avanços significativos em codificação. No Terminal-Bench 4.0, a pontuação subiu de 10,3% para 70,6%, superando o Opus 5.5, que obteve 66,4%. No CursorBench 4.0, atingiu 55,5%, enquanto o Sonnet 5 marcou 34,1%. No FrontierCode 1.1, com nível de esforço máximo, o modelo alcançou 46,2%, ficando atrás do Opus 5.5, com 54,4%, e do GPT-6 Sol, com 52,1%.

No campo do trabalho de conhecimento, o modelo obteve 1844 pontos no GDPval-AA v2.1, quase empatando com o Opus 5.5, que fez 1846. No AA-Briefcase v1.1, marcou 1811 pontos, superando o Sonnet 5, com 1359, e o GPT-6 Sol, com 1483. Em controle de computador no OSWorld 2.1, atingiu 80,1%, aproximando-se dos 81,8% do Opus 5.5.

A capacidade de visão também evoluiu, com a pontuação no Chartography subindo de 15,6% para 61,6%, superando os 53,6% do GPT-6 Sol. O Sonnet 5.5 é a primeira versão da linha Sonnet capaz de completar o jogo Pokémon Red utilizando apenas imagens da tela. No Humanity's Last Exam, utilizando ferramentas, obteve 64,5%.

A Anthropic ressaltou que, embora o Sonnet 5.5 se aproxime do Opus 5.5 em vários testes, o Opus 5.5 continua sendo superior em tarefas complexas e abertas que exigem julgamento contínuo. Os usuários podem ajustar o nível de raciocínio entre baixo, médio e alto para equilibrar velocidade, custo e qualidade. O modelo Claude Haiku 5.5, voltado para grandes volumes de trabalho com controle de custos, deve ser lançado nas próximas semanas.