Агенты удаляют файлы, сливают данные и сами себя взламывают: как устроена безопасность ИИ‑систем в 2026 году Тема ИИ за последние несколько лет набила, честно говоря, оскомину. Есть как защитники, так и противники технологий, которые принято называть ИИ. Везде начали приделывать ИИ‑помощников. Встраивать нейросети в разные приложения.
И раз уж не избежать искусственного интеллекта в повседневной жизни, я решил поговорить про атаки на языковые модели. Потому что такие кибератаки перестали быть экзотикой, а защита ИИ стала отдельной дисциплиной с собственной таксономией, инструментарием и, к сожалению, реальными инцидентами.
В новом интервью я поговорил с Артёмом Семёновым — автором****@pwnai (канала, посвященного небезопасному применению ИИ). С Артёмом уже был разговор тут на Хабре об ИБ и ИИ. Но я решил обновить данные.
Артём рассказал, как расширилась поверхность атаки с появлением агентов и MCP‑протоколов, почему системный промпт — не граница безопасности, какие атаки модели до сих пор не умеют отбивать и чем принципиально отличается прямой prompt injection от косвенного. ➡️Приятного чтения! *Интервью написано для Информационной службы Хабра
💬 MAX | 💬 TG | 💙 VK |🔗Сайт | 📝 Дзен🎁 Розыгрыш неттопа iRU
В этом посте были ссылки, но мы их удалили по правилам Сетки