Claude Mythos победил в BioMysteryBench

Anthropic утверждает, что Claude Mythos догнал экспертов в области биоинформатики

Компания Anthropic представила BioMysteryBench — тест для ИИ на основе реальных биологических данных. Модель Claude показала точность выше 80% на задачах экспертного уровня.

Google AI Overviews приносят деньги

Google заработал на поиске на 19% больше, потому что люди оценили ИИ-ответы

Alphabet отчиталась о рекордной выручке и планах на масштабные инвестиции в ИИ-инфраструктуру до 2026 года, несмотря на дефицит чипов и вопросы к прозрачности доходов.

Модель Tencent для смартфона

Tencent выпустила ИИ-модель на 440 мегабайт для офлайн-перевода на смартфонах

Компания Tencent представила компактную нейросеть Hy-MT1.5-1.8B, которая обеспечивает качественный перевод на 33 языках полностью в офлайн-режиме.

OpenAI готовит GPT-5.5 Cyber

OpenAI готовит GPT-5.5 Cyber: новый этап в гонке вооружений между ИИ-защитой и атакой

Глава OpenAI Сэм Альтман анонсировал запуск GPT-5.5 Cyber, специализированной модели для экспертов по кибербезопасности, ориентированной на защиту критической инфраструктуры.

Apple представила LaDiR

Apple представила LaDiR: гибридный метод рассуждений для языковых моделей

Apple представила фреймворк LaDiR, который позволяет языковым моделям проверять несколько вариантов решения задачи параллельно перед выдачей ответа.

самообучение LLM это коллапс

Исследование показало, что самообучение LLM неизбежно ведет к их коллапсу

Исследования подтверждают, что обучение больших языковых моделей на собственных данных ведет к статистической сингулярности и потере связи с реальностью.