AMD выпускает плагин vLLM-ATOM, который значительно ускоряет работу моделей DeepSeek-R1 и Kimi-K2 на ускорителях Instinct MI350 и MI400 через глубокую оптимизацию ядер.
Стартап Cacheon запускает открытую платформу для соревнований по оптимизации скорости инференса больших языковых моделей на стандартном оборудовании.
OpenAI анонсировала платформу Daybreak, которая объединяет GPT-5.5-Cyber и Codex Security для автоматического поиска и исправления уязвимостей в программном обеспечении.
Baidu выпустила модель Ernie 5.1, сократив расходы на обучение на 94% благодаря дистилляции и новому четырехэтапному конвейеру настройки.
Компания Kuaishou планирует выделить свое ИИ-подразделение Kling в отдельный бизнес с оценкой в 20 миллиардов долларов и провести листинг в Гонконге.
Энтузиасты адаптировали серверную NVIDIA Tesla V100 для домашнего ПК, достигнув скорости в 130 токенов в секунду, что выше показателей современных RTX 3060.