Безопасность

Безопасность и этика искусственного интеллекта. Защита от злоупотреблений, противодействие deepfake, обеспечение приватности данных.

Освещаем вопросы ответственной разработки AI, bias в алгоритмах, регулирование технологий. Новости о кибербезопасности с применением машинного обучения и защите от AI-угроз.

SearchGEO

Новый фреймворк SearchGEO оценил, насколько легко манипулировать поисковыми ИИ-агентами

Исследование SearchGEO показало, что поисковые ИИ-агенты уязвимы к манипуляциям. Уровень успешных атак варьируется от 0% у Claude до 31,4% у Gemini.

CI/CD Abuse Detector

Elastic представила инструмент CI/CD Abuse Detector для защиты процессов разработки

Компания Elastic представила прототип CI/CD Abuse Detector, использующий Claude Code для автоматического поиска вредоносных изменений в процессах сборки.

Mythos взламывает патчи

Модель Mythos доказала, что ИИ способен взламывать патчи безопасности за считанные часы

Команда Anthropic доказала, что современные ИИ-модели способны проводить реверс-инжиниринг патчей безопасности и создавать рабочие эксплойты в течение одного дня.

Непрямая инъекция промптов

LLM могут быть поражены через непрямые инъекции промптов даже при локальном запуске

Исследователи обнаружили, что локальные ИИ-модели так же уязвимы к непрямым инъекциям промптов, как и облачные, из-за архитектурных особенностей LLM.

ChatGPT Lockdown Mode

ChatGPT вводит режим Lockdown Mode, изолирующий нейросеть от внешнего мира

OpenAI представила Lockdown Mode для ChatGPT — новый инструмент безопасности, ограничивающий доступ к интернету для защиты данных от сложных атак.

взлом Salesforce Experience Cloud

Автономного ИИ-агента обучили полному циклу взлома сайтов на Salesforce Experience Cloud

Автономный ИИ-агент научился проводить полный цикл кибератаки на сайты Salesforce Experience Cloud, используя LLM для написания эксплойтов и анализа данных.