Компания Nvidia представила Nemotron 3.5 Lightning — новую компактную модель с открытыми весами, которая демонстрирует впечатляющий баланс между производительностью и скоростью работы. Как сообщает The Decoder, новинка сопоставима по уровню интеллекта с gpt-oss-120b от OpenAI, обладая при этом в четыре раза меньшим количеством параметров.

Модель является прямым наследником архитектуры Nemotron 3 Nano, сохраняя гибридную структуру Mamba-Transformer. Общий объем параметров составляет 31,6 миллиарда, однако благодаря механизму активации в каждый конкретный момент вычислений задействованы лишь 3,6 миллиарда активных параметров, что критически важно для экономии ресурсов.

Согласно данным независимой платформы Artificial Analysis, Lightning набрала 24 балла в индексе интеллекта, что на 9 пунктов выше показателей предыдущего поколения. Хотя модель все еще уступает лидерам своего класса, таким как Qwen3.6 35B или Meta Muse Glimmer, ее преимущество кроется в другом — в феноменальной пропускной способности данных.

Рекорды скорости и агентские возможности

В тестах с использованием финальных весов формата NVFP4 модель выдает почти 670 токенов в секунду. Это делает ее самым быстрым решением в своем сегменте, почти вдвое опережая Gemini 3.5 Flash-Lite от Google. Там, где конкурентам требуется от 3,5 до 5,8 минут на выполнение задачи, Lightning справляется всего за 30 секунд.

Наиболее заметный прогресс зафиксирован в так называемых агентских бенчмарках, оценивающих способность ИИ выполнять сложные цепочки действий. На тесте GDPval-AA v2 модель получила рейтинг Эло 824, что позволило ей обойти даже более крупную Nemotron 3 Super. В задачах Terminal-Bench точность выполнения команд выросла с 7% до 24,3%.

Архитектура Lightning подтверждает тезис о том, что для автоматизации рабочих процессов не всегда нужны гигантские модели. Nvidia умело эксплуатирует нишу быстрых агентов, где задержка важнее глубины философских рассуждений. Однако открытость весов здесь выглядит скорее как попытка продать специализированное железо через экосистему софта, чем как чистый альтруизм. В итоге мы получаем отличный инструмент, который, впрочем, жестко привязывает разработчика к проприетарным форматам вроде NVFP4.

Nvidia распространяет модель под лицензией OpenMDW-1.1, позиционируя ее как основу для высокопроизводительных ИИ-агентов. В процессе дообучения компания сотрудничала с такими партнерами, как CodeRabbit и Harvey, чтобы оптимизировать работу нейросети в специфических прикладных доменах, включая написание кода и юридическую аналитику.

Модель доступна в вариантах BF16 и NVFP4, причем последняя версия практически не теряет в качестве ответов при значительном выигрыше в ресурсах. Nemotron 3.5 Lightning работает исключительно с текстом, поддерживает контекстное окно объемом один миллион токенов и уже доступна для использования через облачных провайдеров, таких как DeepInfra, Fireworks и CoreWeave.