YouTube внедряет ИИ для оценки возраста пользователей: что важно знать

YouTube внедряет ИИ-системы для оценки возраста пользователей без верификации. Алгоритмы анализируют поведение, но точность и приватность вызывают вопросы экспертов.

OpenAI пообещала не удалять старые модели ChatGPT без предупреждения после скандала с GPT-5

OpenAI изменит политику вывода моделей из эксплуатации после скандала с GPT-5. Теперь компания будет предупреждать за 30 дней и сохранять API-доступ к старым версиям ещё 90 дней.

FilBench: бенчмарк для оценки языковых моделей теперь понимает филиппинские языки

Hugging Face представил FilBench — первый бенчмарк для оценки LLM на филиппинских языках. Тестирование 41 модели выявило лидеров и слабые места, особенно в генерации текста.

TextQuests оценил, насколько эффективны языковые модели в текстовых играх

Новый бенчмарк TextQuests на классических текстовых играх вскрыл слабости LLM в долгосрочном планировании и пространственном мышлении. Модели галлюцинируют в длинных сессиях и неэффективно тратят вычислительные ресурсы.

Lambda запускает облачные инстансы с NVIDIA Blackwell: прорыв для обучения LLM

Lambda запустила инстансы с 8 GPU NVIDIA B200 по $4.99/GPU-час. Архитектура Blackwell обещает 3× ускорение обучения LLM и 15× рост скорости инференса.

Claude теперь обрабатывает целые проекты за один запрос: революция для разработчиков

Claude Sonnet 4 теперь обрабатывает 1 млн токенов, позволяя анализировать целые кодобазы. Но рост возможностей сопровождается ценовыми и бизнес-рисками для Anthropic.