Investimento · 26 de setembro de 2026

Também publicado em עברית, Русский

Anthropic lança Opus 5.5 com desempenho avançado e custo reduzido

a person giving a presentation
Jj Englert / Unsplash

Anthropic lançou em 23 de setembro de 2026 o modelo Opus 5.5, que apresenta desempenho comparável ao Fable 5.1 mas com custo de uso cerca de 40 por cento menor. O lançamento ocorreu no mesmo dia em que a empresa divulgou resultados de testes realizados por parceiros externos, como Frontier Design e METR, que confirmaram a capacidade do modelo em várias métricas.

Nos testes de programação, Opus 5.5 alcançou 66,4 por cento no Terminal-Bench 4.0, superando o Fable 5.1 (55,8 por cento) e o Opus 5 (52,3 por cento). No benchmark CursorBench 4.0, a pontuação foi de 57,8 por cento, frente a 41,7 por cento do GPT-5.6 Sol. Em tarefas de conhecimento, o modelo obteve 1846 pontos Elo no GDPval-AA v2.1, liderando sobre Fable 5.1 (1735), Opus 5 (1708) e GPT-6 Astra (1542). Também se destacou em OSWorld 2.0 (81,8 por cento) e Humanity's Last Exam (67,7 por cento).

Apesar dos resultados positivos, Opus 5.5 não liderou todas as avaliações; manteve vantagem apenas em alguns conjuntos, como AutomationBench e Terminal-Bench-Science, onde GPT-6 Astra ainda registrou pontuações superiores. A empresa reconheceu que, em níveis elevados de esforço, a diferença de desempenho entre Opus 5.5 e Fable 5.1 torna-se menos relevante.

O custo por token também foi reduzido: entrada a 4 dólares e saída a 20 dólares por mil tokens, representando uma queda de 20 por cento em relação ao Opus 5. Além disso, as leituras de cache caíram de 6,25 para 0,20 dólares, e a escrita de cache diminuiu de 6,25 para 5 dólares, resultando em redução total de cerca de 40 por cento nos custos.

Para acelerar processos, o Opus 5.5 oferece modo rápido que aumenta a velocidade até 2,5 vezes, com preço de 8 dólares por entrada e 40 dólares por mil tokens de saída. Usuários assinantes recebem cotas adicionais nos planos Pro, Max, Team e Enterprise, além de possibilidade de redefinir limites de taxa de uso.

Em testes internos, o Opus 5.5 concluiu a migração de 200 mil linhas de código em menos de três horas, enquanto o Opus 5 demandou mais de 20 horas e consumiu mais de duas vezes o número de tokens. A migração de HAProxy de C para Rust foi concluída em 9,5 horas, 51 por cento mais barata que a execução do Opus 5.

A segurança foi reforçada com um classificador que analisa cada ação antes da execução, sandbox aberto para revisão da equipe de segurança e detecção proativa de vulnerabilidades. O modelo também mostrou resistência superior a tentativas de prompt injection, com taxa de sucesso mínima nos testes da Gray Swan.

Em avaliações de geração de relatórios financeiros, o Opus 5.5 passou em 16 dos 18 critérios de verificação de fatos, enquanto Fable 5.1 e Opus 5 falharam em todos. O Walleye Capital, investidor que participou dos testes, destacou que o modelo foi capaz de identificar inconsistências nas instruções de avaliação, algo inédito entre os modelos analisados.

Informado por Techsauce.