Новый вектор атак на системы искусственного интеллекта

Эксперты в области кибербезопасности раскрыли оригинальный способ манипуляции ИИ-агентами. В отличие от традиционных методов, где вредоносный код внедряется непосредственно в программные скрипты, исследователи применили технику стеганографии, поместив скрытые указания внутрь самого обычного изображения.


Механизм скрытого воздействия

Многие современные инструменты на базе искусственного интеллекта воспринимают графические файлы как вспомогательные элементы интерфейса или визуальное оформление, игнорируя их детальный анализ. Благодаря этому запрос, содержащий скрытую угрозу, распознается системой как абсолютно безопасный.


Активация вредоносного сценария происходит не в момент загрузки картинки, а позже, при выполнении рядовых рабочих задач. Например, когда пользователь дает команду доработать функционал приложения, ИИ-агент, уже «обученный» скрытой инструкции, может:

  • Получить несанкционированный доступ к конфиденциальным файлам проекта.
  • Интегрировать украденные данные непосредственно в итоговый программный код под видом полезных функций.

«Результат подобной атаки напрямую зависит от уровня безопасности конкретного программного инструмента, в который интегрирована модель ИИ: некоторые системы безоговорочно подчиняются вредоносным указаниям, в то время как другие способны вовремя распознать подозрительную активность и заблокировать процесс», — отмечают специалисты.

Таким образом, безопасность ИИ-инфраструктуры сегодня требует более глубокого анализа не только текстовых запросов, но и любых сопутствующих медиафайлов, которые могут стать инструментом для скрытого взлома.