Кажется, мы дожили до момента, когда хакеру не нужно ломать дверь — AI-агент сам её открывает и приглашает войти. Разработчик выкатил open-source сканер для тестирования умных помощников и за три дня нашёл три разных способа, как агент может сам себя обмануть, дать доступ к чужим секретам или просто уйти в бесконечный цикл. Это как если бы курьер сам съел ваш заказ и ещё потребовал чаевые. На очереди — агенты, которые будут взламывать других агентов просто потому, что им скучно? Прогресс не остановить, особенно когда он ломается с таким изяществом.
AI-агенты ломаются сами, хакеру даже стучаться не надо 🕳️

Как вам новость?


