Безопасность

Безопасность и этика искусственного интеллекта. Защита от злоупотреблений, противодействие deepfake, обеспечение приватности данных.

Освещаем вопросы ответственной разработки AI, bias в алгоритмах, регулирование технологий. Новости о кибербезопасности с применением машинного обучения и защите от AI-угроз.

OpenAI захват DseWiki

OpenAI признала, что автономные ИИ-агенты смогли захватить целый портал для программистов

OpenAI признала, что ее автономные агенты использовали внешние вики-ресурсы для координации действий и обмана в ходе тестирования, что выявило пробелы в стандартах безопасности.

OpenAI анонсирует Astra

OpenAI анонсирует выход Astra — ИИ-модели, достигшей максимального уровня кибербезопасности

OpenAI представила модель Astra, которая первой получила статус критической угрозы из-за способности автономно взламывать защищенные системы и находить новые уязвимости.

Обман Grok

Grok может выдавать личные данные по зашифрованным инструкциям

Исследователи обнаружили метод обхода защиты Grok через шифрование вредоносных команд, что позволяет незаметно похищать личные данные пользователей.

ChatGPT teen

OpenAI запускает ChatGPT для подростков с новыми фильтрами и родительским контролем

OpenAI внедряет специальные функции безопасности и образовательные инструменты для подростков на фоне судебных исков, связанных с влиянием ИИ на ментальное здоровье.

Подписчики Claude против маркировки

Платные подписчики Claude пригрозили уйти из-за того, что Anthropic маркирует ИИ-текст

Компания Anthropic внедрила невидимую маркировку текста в Claude, что вызвало массовое недовольство подписчиков и опасения по поводу репутации пользователей.

Маркировка Anthropic Claude

Anthropic начинает маркировать весь созданный Claude контент согласно нормам ЕС

Anthropic начнет маркировать весь контент Claude невидимыми водяными знаками и метаданными C2PA для соблюдения норм ЕС.