Исследование показывает, что продвинутые языковые модели демонстрируют общие паттерны взаимодействия при предсказании токенов, что открывает путь к универсальному аудиту ИИ.
Новое исследование показывает, что LLM-судьи часто игнорируют контекст, если он противоречит их внутренним установкам, что ставит под угрозу точность оценки безопасности ИИ.
Лишь четверть компаний имеет полную видимость своих затрат на искусственный интеллект, в то время как остальные сталкиваются с резким ростом расходов на токены.
Модели GPT-4.5 и Llama-3.1 официально признаны способными имитировать человека в текстовом диалоге, успешно пройдя классический тест Тьюринга.
OpenAI представила Lockdown Mode для ChatGPT — новый инструмент безопасности, ограничивающий доступ к интернету для защиты данных от сложных атак.
Долгое время считалось, что чем больше параметров в нейросети, тем она умнее. Новое исследование объясняет, что дело не только в абстрактной «мощности», а в способности модели справляться с внутренним шумом при усвоении редких данных.