Учимся взламывать ИИ-агентов на практике
ИИ-агенты становятся все сложнее, но вместе с новыми возможностями появляются и новые классы уязвимостей.
На воркшопе разберем, как устроены современные агентные системы и какие техники используются для их тестирования на безопасность. Каждый участник получит доступ к учебному веб-приложению с ИИ-агентом и набором практических заданий, позволяющих последовательно пройти основные сценарии атак.
Начнем с краткого обзора архитектуры ИИ-агентов и принципов их взаимодействия с данными. Затем на практике рассмотрим обход защитных механизмов (guardrails), различные техники prompt injection, атаки на вызов инструментов (tool calling), indirect prompt injection и особенности эксплуатации мультиагентных систем.
Каждый блок включает небольшую теоретическую часть с разбором механизма работы уязвимости, демонстрацию техники и самостоятельную практику участников. В процессе можно будет протестировать разные LLM и сравнить, как отличаются их защитные механизмы.
В результате участники получат практический опыт поиска и эксплуатации уязвимостей агентных систем, лучше поймут особенности защиты современных LLM и познакомятся с набором техник, которые применяются при пентесте ИИ-агентов.