OpenAI предоставила девяти британским банкам доступ к инструменту кибербезопасности GPT-5.5 Cyber, заполнив нишу после отказа Anthropic поставлять модель Mythos.
Стартап Datacurve представил DeepSWE — новый бенчмарк для ИИ-кодеров, который выявил превосходство GPT-5.5 и критические ошибки в старых методах оценки.
Крупный счет в 1,3 млн долларов за использование API OpenAI выявил реальную стоимость содержания флота автономных ИИ-агентов в разработке.
Использование новых моделей ИИ от Anthropic и OpenAI позволило Palo Alto Networks обнаружить в семь раз больше уязвимостей в своих продуктах, чем обычно.
OpenAI обновила стандартную модель ChatGPT до GPT-5.5 Instant, значительно снизив уровень фактических ошибок и улучшив персонализацию ответов.
Исследование ARC-AGI-3 показало, что даже передовые модели вроде GPT-5.5 совершают критические ошибки в логике, не дотягивая до 1% успеха.