Китайский стартап Z.ai представил новую итерацию своей языковой модели — GLM-5.3, которая продемонстрировала впечатляющие результаты в свежих тестах производительности. Как пишет The Decoder, разработка набрала 60 баллов в индексе Artificial Analysis Intelligence Index, что позволило ей разделить первую строчку в сегменте моделей с открытыми весами вместе с Kimi K3.
Прогресс по сравнению с предыдущей версией GLM-5.2 составил семь пунктов, что в мире больших языковых моделей (LLM) считается серьезным шагом вперед. Особого внимания заслуживает динамика в агентных задачах, где система должна не просто генерировать текст, а выступать в роли автономного исполнителя. В тесте GDPval-AA v2 показатель Elo подскочил на 246 пунктов, достигнув отметки 1 770, что выводит модель на второе место в мире, уступая лишь Claude Opus 5.
Экономика и безопасность открытого кода
Вопрос стоимости эксплуатации традиционно остается «узким местом» для корпоративного сектора, и здесь Z.ai ведет агрессивную ценовую политику. Аналитики из Artificial Analysis оценивают выполнение одной задачи на GLM-5.3 в $0,68. Хотя это в полтора раза дороже предшественника, новая модель оказывается на 19% экономнее своего прямого конкурента Kimi K3, чья цена составляет $0,84.
Однако релиз сопровождается неожиданным препятствием, которое разработчики объясняют заботой о безопасности. Z.ai отложила публикацию открытых весов модели примерно на две недели. Официальная причина звучит почти как комплимент собственному продукту: GLM-5.3 оказалась настолько эффективной в поиске уязвимостей, что компания решила сначала усилить механизмы контроля и предоставить доступ лишь ограниченному кругу партнеров по кибербезопасности.
Лидерство китайских моделей в открытых бенчмарках часто сопровождается вопросами о специфике обучающих выборок, но GLM-5.3 демонстрирует реальную инженерную зрелость в агентных сценариях. Однако задержка публикации весов под предлогом избыточной эффективности в кибервзломах выглядит скорее как попытка выиграть время для настройки фильтров цензуры или доработки инфраструктуры API. Рынок получает мощный инструмент, но «открытость» здесь остается лишь маркетинговым ярлыком, пока полный доступ ограничен регуляторными опасениями.
На текущий момент взаимодействие с новой моделью возможно исключительно через программный интерфейс (API) стартапа Z.ai. Для профессионального сообщества этот промежуточный этап станет проверкой того, насколько заявленные 60 баллов в индексе соответствуют реальной продуктивности в прикладных задачах, где важна не только сухая статистика, но и стабильность ответов.
Если обещания разработчиков подтвердятся, и через две недели веса будут опубликованы без критических ограничений, индустрия получит одну из самых мощных альтернатив западным проприетарным решениям. Впрочем, в индустрии ИИ двухнедельные задержки иногда имеют свойство превращаться в неопределенность, заставляя вспомнить о том, что путь к настоящему open source часто преграждают корпоративные и государственные интересы.
Оставить комментарий