Fable 5 лидирует в бенчмарке по кодингу, а показатели GPT-5.5 резко рухнули
Модель Claude Fable 5 установила новый рекорд в бенчмарке MirrorCode, в то время как GPT-5.5 показала резкое снижение результатов из-за изменения условий тестирования.
Модель Claude Fable 5 установила новый рекорд в бенчмарке MirrorCode, в то время как GPT-5.5 показала резкое снижение результатов из-за изменения условий тестирования.
GPT-5.6 Sol демонстрирует производительность на уровне флагманов Anthropic, сокращая расходы на использование ИИ в три раза и меняя правила игры на рынке.
Anthropic представила стратегии использования Claude Fable 5 в качестве менеджера для Sonnet 5, что позволяет сократить расходы на ИИ почти вдвое без потери качества.
Инженер Google DeepMind перенес культовую игру Command & Conquer: Generals на iOS за несколько часов, используя инструменты Anthropic.
Anthropic радикально сократила системные инструкции для Claude Code, обнаружив, что новые модели класса Mythos показывают лучшие результаты при минимуме ограничений.
Согласно новому индексу Remote Labor Index, возможности ИИ по выполнению фриланс-заказов выросли в четыре раза, достигнув отметки в 16,1%.