Top.Mail.Ru
Разработка
Безопасность
AgentSecOops: где ломаются ИИ-агенты и как их защищать
4 октября
17.40-18.10
Green 5. ML & AI & Безопасность

AI-агенты работают не только с промптами и ответами модели, они обращаются к RAG, MCP-серверам, инструментам и внешним системам, поэтому атаковать их можно сразу через несколько точек. При этом одного фильтра перед LLM или надежного системного промпта недостаточно, так как вредоносная инструкция может попасть в контекст из документа, результата работы инструмента или внешнего сервиса, а ошибка модели может привести уже не просто к неправильному ответу, а к выполнению реального действия. В докладе рассказываем, как выглядят современные атаки на AI-агентов и какие подходы к построению многоуровневой защиты: где ставить проверки, как контролировать входные данные, RAG-контекст, ответы модели и вызовы инструментов, а так же как ограничивать права и последствия успешной атаки. В результате поймем общую карту рисков AI-агента, поймет где в его архитектуре находятся основные точки атаки и какие механизмы можно использовать, чтобы защитить систему и уменьшить возможный ущерб, если один из уровней защиты все же не сработал.