Оглавление

Компания Anthropic представила Claude Opus 5.5, первую модель в своем новом семействе нейросетей. По заявлению разработчиков, новинка достигает производительности флагманской Claude Fable 5.1, при этом работая значительно быстрее и обходясь дешевле в эксплуатации. Как сообщает издание The Decoder, модель уже доступна на основных облачных платформах, включая AWS, Google Cloud и Azure.

Бенчмарки Anthropic демонстрируют превосходство Opus 5.5 над GPT-6 Astra от OpenAI в большинстве задач, особенно в агентном программировании и междисциплинарном мышлении. Примечательно, что высокая производительность сочетается с агрессивной ценовой политикой: стоимость входных токенов снижена на 20%, а общие операционные расходы упали почти на 40% по сравнению с предыдущей версией Opus 5.

Эффективность и борьба с «клодизмами»

Одним из ключевых изменений в Opus 5.5 стала работа над стилистикой ответов. Пользователи часто критиковали прошлые модели за специфический, витиеватый слог, получивший название «Claudish». Новая итерация призвана писать более естественно, ставить важную информацию в начало ответа и избегать избыточного профессионального жаргона, что делает её более удобным инструментом для длительной работы.

Для разработчиков и корпоративного сектора важным обновлением стали показатели в Terminal-Bench 4.0, где Opus 5.5 показывает результат 66,4%, значительно опережая конкурентов. В задачах по автоматизации рабочих процессов модель практически сравнялась с Astra, сохраняя при этом кратно меньшую стоимость выполнения одной задачи.

Снижение цен на токены при одновременном росте их потребления на задачу — классический маневр по удержанию маржинальности через объем. Anthropic создали мощный инструмент, но его «прожорливость» в режиме максимальной точности нивелирует экономию для сложных проектов. Это изящная попытка замаскировать аппаратную неэффективность за привлекательным ценником на вход, оставляющая открытым вопрос реальной окупаемости в продакшене.

Безопасность и регуляторные требования

Anthropic продолжает придерживаться строгой политики безопасности, внедряя защитные механизмы для кибербезопасности и биологических исследований. В Opus 5.5 реализована функция Preserved Thinking, которая блокирует попытки извлечь внутренние рассуждения модели через манипуляции с контекстом API, что является ответом на так называемые «атаки дистилляции».

В рамках соответствия EU AI Act модель получила встроенные механизмы водяных знаков и поддержку режима Zero Data Retention. Стоит отметить, что Anthropic призывает к установлению более высоких международных стандартов безопасности для моделей, способных автоматизировать исследования в области самого ИИ, подчеркивая необходимость государственного регулирования этой сферы.

Независимая оценка производительности

Платформа Artificial Analysis подтвердила амбиции Anthropic, поместив Opus 5.5 на вершину своего индекса интеллекта с результатом 58 баллов. Модель лидирует в шести из десяти категорий тестирования, включая сложнейший экзамен Humanity’s Last Exam. В тестах на написание кода и научные рассуждения новинка также установила новые рекорды индустрии.

Однако эксперты указывают на нюанс: при максимальных настройках усилий Opus 5.5 расходует около 119 000 токенов на задачу, что почти в полтора раза больше, чем у предшественников. Таким образом, реальная экономия средств достигается преимущественно за счет снижения базовых тарифов, а не за счет лаконичности самой модели.