Anthropic выпустила Claude Sonnet 5.5 — на 30% быстрее и до 30% дешевле в работе без повышения цен
Anthropic представила Claude Sonnet 5.5 и открыла доступ к ней в приложении Claude, через API и на платформах AWS, Google Cloud и Microsoft Azure. Это вторая новинка компании за неделю: флагманская Opus 5.5 вышла 22 сентября. По данным Anthropic, Sonnet 5.5 стала первой моделью своей линейки, которая смогла пройти Pokémon Red, ориентируясь только на скриншоты игры. Это показывает, насколько лучше она справляется с долгими задачами и пониманием изображений.
Sonnet 5.5 генерирует ответы более чем на 30% быстрее предшественницы и стала самой быстрой моделью в линейке Sonnet. При этом тарифы API остались прежними: $2 за миллион входных токенов (около 170 рублей), $10 за миллион выходных (примерно 840 рублей) и $0,20 за миллион токенов чтения кэша (около 17 рублей). За счёт того, что модель обычно тратит меньше токенов на те же задачи, стоимость выполнения задачи может быть до 30% ниже.
В тесте Terminal-Bench 4.0 новая модель набрала 70,6% против 10,3% у Sonnet 5 — и даже обошла Opus 5.5 с её 66,4%. В CursorBench 4.0 результат составил 55,5% против 34,1%. В тесте GDPval-AA v2.1 на выполнение рабочих задач Sonnet 5.5 получила 1844 балла — почти столько же, сколько Opus 5.5 с 1846 баллами.
По словам Anthropic, Sonnet 5.5 лучше всего подходит для повседневных задач, исправления ошибок в коде и создания документов, слайдов и таблиц. Она также стала первой моделью линейки Sonnet с защитными механизмами в сфере кибербезопасности, аналогичными тем, что применяются в Opus 5.5: при рискованных запросах из этой сферы модель заметно для пользователя переключается на Sonnet 5, а обычная работа с кодом не затрагивается. В ближайшие недели линейку дополнит Claude Haiku 5.5 для массовых и недорогих задач.
Своими впечатлениями поделился операционный директор Epic Games — создателей Fortnite и Unreal Engine — Дэниел Фогель (Daniel Vogel). По его словам, в тестах модель работала с десятками тысяч строк кода архитектуры игровых систем и выдерживала многочасовые задачи.
В раннем тестировании Epic Games Claude Sonnet 5.5 достигла того же уровня качества, которого ждут от модели более высокого класса, справившись с проверкой архитектуры игровой системы и анализом потоков данных.
Станет ли более высокая скорость и меньшая стоимость выполнения задач достаточным поводом перейти на Sonnet 5.5 с предыдущей модели?
-
Anthropic тестирует Claude для управления роботами в биоэкспериментах -
GPT-6 Astra ускоряется втрое, если сказать, что Claude справился бы лучше -
Anthropic выпустила Claude Opus 5.5 — уровень Fable 5.1 за 40% от её цены, а лимиты подписок подняли -
Claude спроектировал печатную плату без участия человека — эксперимент обошёлся в 38 тысяч рублей

