Технологии

Claude Opus 5.5 стал на 40% дешевле — и вышел после призыва Anthropic притормозить ИИ

Susan Hill
Добавьте нас в Google

Claude Opus 5.5 делает то, чего не делали предыдущие модели Anthropic: она стоит меньше и работает быстрее, при этом соответствуя или превосходя более крупную и дорогую систему. Модель справляется с агентным кодингом, работой с компьютером, чтением графиков и междисциплинарным рассуждением на уровне, который, по данным самой Anthropic, превышает показатели Claude Fable 5.1 — предыдущей самой мощной модели компании — по ряду параметров. Для пользователей и разработчиков, которые считали Opus 5 полезной, но дорогой, разрыв между тем, на что способна модель, и тем, сколько она стоит, существенно сократился.

Разница в цене конкретна. Opus 5.5 взимает $4 за миллион входных токенов и $20 за миллион выходных токенов; Opus 5 стоил $5 и $25 соответственно. Кэшированные чтения снизились с $0,50 до $0,20 за миллион токенов. Anthropic утверждает, что типовые рабочие нагрузки в целом обходятся примерно на 40% дешевле. Скорость следует той же траектории: стандартная модель генерирует текст более чем на 30% быстрее Opus 5. Отдельный быстрый режим, оценённый в $8 за входные и $40 за выходные токены на миллион, достигает скорости до 2,5 раз выше стандартной Opus 5 — полезная опция для приложений, чувствительных к задержкам.

Опубликованные Anthropic показатели производительности ставят Opus 5.5 впереди Fable 5.1, Opus 5 и GPT-6 Astra по четырём из шести бенчмарков. На Terminal-Bench 4.0, который тестирует выполнение кода в среде живого терминала, Opus 5.5 набирает 66,4% против 55,8% у Fable 5.1. На Humanity’s Last Exam — тесте, охватывающем академические и профессиональные знания из разных дисциплин, — результат 67,7% против 65,6%. OSWorld 2.0, измеряющий работу с компьютерным интерфейсом, показывает 81,8% против 80,7%. Тест Deloitte показал, что Opus 5.5 при самом низком уровне усилий выявил 72% известных ошибок в коде при ревью, против 56% у Opus 5 при высоких усилиях. Эти цифры предоставлены Anthropic и её избранными партнёрами; заявленные погрешности колеблются от ±1,6 до ±5 процентных пунктов, и независимая сторонняя верификация на момент запуска не опубликована.

Две области нарушают закономерность. На AutomationBench GPT-6 Astra набирает 41,4% против 40,0% у Opus 5.5. На Terminal-Bench-Science разрыв больше: Astra достигает 64,6%, тогда как Opus 5.5 останавливается на 58,7%. Оба различия укладываются в заявленные погрешности — возможно, это шум — но возможно, и нет. Anthropic включает эти строки в свою собственную опубликованную таблицу, что делают далеко не все компании при запуске. Цифрам всё ещё требуется независимая проверка, прежде чем их можно считать установленными.

В отношении безопасности Anthropic сообщает, что Opus 5.5 была оценена до выпуска внешними командами, включая METR. В собственном внутреннем поведенческом аудите компании, включающем почти 2000 сценариев, разработанных для проверки, пытается ли модель обходить наложенные на неё ограничения, Opus 5.5 описывается как на 85% менее склонная к таким попыткам, чем Opus 5. Более сильные модели, как правило, более способны находить обходные пути, что делает улучшение значимым, если оно подтвердится. Опыт реального развёртывания станет настоящей проверкой.

Что делает этот запуск необычным — его время. Ранее в этом месяце генеральный директор Anthropic Дарио Амодей (Dario Amodei) опубликовал эссе, в котором написал, что он убедился: полное решение рисков ИИ требует «замедления темпа развития возможностей, чтобы предотвращение рисков успевало за ним». Сэм Альтман (Sam Altman) из OpenAI и Илон Маск (Elon Musk) выразили согласие с общей озабоченностью. Дженсен Хуанг (Jensen Huang) из Nvidia заявил, что фундаментальная наука этого не подтверждает. И тут Anthropic выпускает модель быстрее, дешевле и мощнее своей предшественницы. Одно прочтение: модель с лучшими оценками безопасности и более широким доступом — это именно то, что имел в виду Амодей. Другое: эссе называло развитие возможностей проблемой, и возможности продвинулись. Оба прочтения укладываются в один и тот же набор фактов, и одних бенчмарков Anthropic недостаточно, чтобы решить, какое из них верно.

Claude Opus 5.5 доступна с 22 сентября 2026 года под идентификатором модели API claude-opus-5-5. Она работает внутри Claude на планах Pro, Max, Team и Enterprise, а также доступна через AWS, Google Cloud и Microsoft Azure. Anthropic повышает лимиты использования на пятичасовых подписках. Sonnet 5.5 и Haiku 5.5, остальные участники семейства 5.5, запланированы к выходу в ближайшие недели, без объявленных цен или конкретной даты релиза для каждой.

Теги: , , , , ,

Добавьте нас в Google

Обсуждение

Имеется 0 комментариев.