Одинаковое мышление LLM

Исследование показало, что крупные LLM часто «мыслят» похоже и дают одинаковые ответы

Исследование показывает, что продвинутые языковые модели демонстрируют общие паттерны взаимодействия при предсказании токенов, что открывает путь к универсальному аудиту ИИ.

LLM-судьи не понимают контекст

ИИ-судьи не могут быть беспристрастными, потому что часто игнорируют новый контекст

Новое исследование показывает, что LLM-судьи часто игнорируют контекст, если он противоречит их внутренним установкам, что ставит под угрозу точность оценки безопасности ИИ.

Расходы компаний на токены

Компании слабо контролируют расходы на ИИ, потому что бюджет считается в токенах

Лишь четверть компаний имеет полную видимость своих затрат на искусственный интеллект, в то время как остальные сталкиваются с резким ростом расходов на токены.

Тест Тьюринга для ИИ

Две современные LLM успешно прошли больше половины попыток в тесте Тьюринга

Модели GPT-4.5 и Llama-3.1 официально признаны способными имитировать человека в текстовом диалоге, успешно пройдя классический тест Тьюринга.

ChatGPT Lockdown Mode

ChatGPT вводит режим Lockdown Mode, изолирующий нейросеть от внешнего мира

OpenAI представила Lockdown Mode для ChatGPT — новый инструмент безопасности, ограничивающий доступ к интернету для защиты данных от сложных атак.

Крупные LLM обучаются лучше

Исследование объяснило, почему крупные LLM обучаются лучше, чем небольшие модели

Долгое время считалось, что чем больше параметров в нейросети, тем она умнее. Новое исследование объясняет, что дело не только в абстрактной «мощности», а в способности модели справляться с внутренним шумом при усвоении редких данных.