GPT-5.5

Новости

Remote Labor Index

ИИ-агенты могут закрыть уже больше 16% задач фрилансеров

Согласно новому индексу Remote Labor Index, возможности ИИ по выполнению фриланс-заказов выросли в четыре раза, достигнув отметки в 16,1%.

Meta Watermelon

Meta* разрабатывает ИИ-модель Watermelon, которая приблизилась к показателям GPT-5.5

Компания Meta* вплотную приблизилась к показателям GPT-5.5 от OpenAI в ключевых тестах производительности с новой нейросетью Watermelon. Глава подразделения супер интеллекта Александр Ванг проинформировал сотрудников о впечатляющих результатах.

CEO-Bench

Большинство ИИ-моделей провалили тест по управлению стартапом в течение 500 дней

Исследование Принстона показало, что современные ИИ-агенты слабы в долгосрочном планировании: в симуляции стартапа CEO-Bench большинство моделей обанкротились.

ChatGPT health

В ChatGPT добавят обновление, которое сможет более точно отвечать на вопросы по медицине

OpenAI обновила ChatGPT, представив модель GPT-5.5 Instant, которая на 71% точнее отвечает на медицинские вопросы благодаря участию сотен врачей в обучении.

Fable 5 vs GPT-5.5

Claude Fable 5 оказалась слабее GPT-5.5 в новом стресс-тесте для ИИ-агентов Agents’ Last Exam

Новый бенчмарк ALE от ученых из Беркли показал, что GPT-5.5 справляется с комплексными профессиональными задачами лучше конкурентов, хотя общий уровень готовности ИИ остается низким.

GPT-5.5 архитектор систем

В Lovable признали, что GPT-5.5 лучше справляется с проектированием сложных IT-проектов

Модель GPT-5.5 демонстрирует значительный рост эффективности в проектировании сложных систем, снижая количество ре-промптов и улучшая удержание контекста.