Новый фреймворк SearchGEO оценил, насколько легко манипулировать поисковыми ИИ-агентами
Исследование SearchGEO показало, что поисковые ИИ-агенты уязвимы к манипуляциям. Уровень успешных атак варьируется от 0% у Claude до 31,4% у Gemini.
Безопасность и этика искусственного интеллекта. Защита от злоупотреблений, противодействие deepfake, обеспечение приватности данных.
Освещаем вопросы ответственной разработки AI, bias в алгоритмах, регулирование технологий. Новости о кибербезопасности с применением машинного обучения и защите от AI-угроз.
Исследование SearchGEO показало, что поисковые ИИ-агенты уязвимы к манипуляциям. Уровень успешных атак варьируется от 0% у Claude до 31,4% у Gemini.
Компания Elastic представила прототип CI/CD Abuse Detector, использующий Claude Code для автоматического поиска вредоносных изменений в процессах сборки.
Команда Anthropic доказала, что современные ИИ-модели способны проводить реверс-инжиниринг патчей безопасности и создавать рабочие эксплойты в течение одного дня.
Исследователи обнаружили, что локальные ИИ-модели так же уязвимы к непрямым инъекциям промптов, как и облачные, из-за архитектурных особенностей LLM.
OpenAI представила Lockdown Mode для ChatGPT — новый инструмент безопасности, ограничивающий доступ к интернету для защиты данных от сложных атак.
Автономный ИИ-агент научился проводить полный цикл кибератаки на сайты Salesforce Experience Cloud, используя LLM для написания эксплойтов и анализа данных.