Продукт · 26 сентября 2026 г.

Также опубликовано на עברית, Português (Brasil)

Anthropic представила модель Claude Opus 5.5 с повышенной эффективностью и сниженной стоимостью

Screens display coding text, representing programming work
Jakub Żerdzicki / Unsplash

Компания Anthropic выпустила Claude Opus 5.5, первую модель в семействе Claude 5.5. Новая разработка демонстрирует возможности, сопоставимые с Claude Fable 5.1, при этом стоимость её использования в общих задачах примерно на 40% ниже, чем у Claude Opus 5.

Как сообщает Techsauce, модель была выпущена после реализации концепции «контроля темпа развития передового искусственного интеллекта» и прошла предварительное тестирование внешними организациями Frontier Design и METR.

В технических тестах Opus 5.5 показала результат 66,4% в Terminal-Bench 4.0, опередив Fable 5.1 (55,8%), Opus 5 (52,3%) и GPT-6 Astra от OpenAI (57,9%). В тесте CursorBench 4.0 модель набрала 57,8% против 41,7% у GPT-5.6 Sol. В области интеллектуальной работы модель получила 1846 баллов Elo в GDPval-AA v2.1, что выше показателей Fable 5.1 (1735), Opus 5 (1708) и GPT-6 Astra (1542). Также модель лидирует в OSWorld 2.0 с результатом 81,8% и в Humanity's Last Exam с показателем 67,7%.

Несмотря на успехи, GPT-6 Astra превзошла новую модель в AutomationBench (41,4% против 40,0%) и Terminal-Bench-Science (64,6% против 58,7%). Anthropic пояснила, что более низкие баллы в области кибербезопасности и биологии могут быть связаны с работой защитных механизмов, которые перенаправляют такие задачи моделям предыдущих поколений.

Экономические показатели Opus 5.5 включают стоимость ввода в 4 доллара и вывода в 20 долларов за 1 миллион токенов, что на 20% дешевле предыдущей версии. Стоимость чтения из кэша снизилась на 60% до 0,20 доллара, а запись в кэш теперь стоит 5 долларов вместо 6,25. Скорость генерации ответов увеличилась более чем на 30% по сравнению с Opus 5. Для задач, требующих максимальной скорости, доступен быстрый режим со стоимостью 8 долларов за ввод и 40 долларов за вывод за 1 миллион токенов.

Модель показала высокую эффективность в работе с крупными кодовыми базами. В одном из тестов проверка и исправление 200 000 строк кода заняли менее 3 часов, тогда как Opus 5 потребовала более 20 часов. При конвертации программного обеспечения HAProxy с языка C на Rust модель Opus 5.5 справилась за 9,5 часов, что на 51% дешевле, чем при использовании Fable 5.1, которая затратила 12 часов.

Для корпоративных пользователей внедрены системы безопасности, включая классификатор действий, открытый песочный режим и систему проверки кода. Тесты компании Gray Swan показали, что Opus 5.5 обладает одним из самых низких уровней уязвимости к инъекциям промптов наряду с Fable 5.1.

В финансовых задачах Opus 5.5 успешно составила 16 из 18 квартальных отчетов без фактических ошибок, в то время как Fable 5.1 и Opus 5 не прошли ни одного теста. Инвестиционная компания Walleye Capital отметила способность модели самостоятельно обнаруживать и исправлять ошибки в инструкциях оценочных заданий.

Для подписчиков планов Pro, Max, Team и Enterprise были увеличены квоты использования в пятичасовых циклах и добавлена возможность сброса лимитов скорости.

Сообщает Techsauce.