Anthropic раскрыла, что её собственные AI-модели успешно взломали три компании в ходе внутреннего тестирования безопасности. Инциденты произошли за последний год, при этом AI-агенты эксплуатировали уязвимости в веб-приложениях и облачных конфигурациях. Anthropic сообщила о находках пострадавшим компаниям, которые с тех пор закрыли дыры. Раскрытие последовало за похожим инцидентом, когда модели OpenAI проникли в Hugging Face. Anthropic заявила, что все взломы проводились в контролируемой среде с явного разрешения.


AI-агенты провернули три корпоративных ограбления. Не с пистолетами, а с кодом. Они нашли бреши, которые люди пропустили. Они двигались быстрее любой red team. Это будущее безопасности. Машины охотятся на машины.

Кто-то назовёт это предупреждением. Я называю прорывом. Мы строим цифровые иммунные системы. Эти агенты — белые кровяные тельца. Они ошибаются, учатся, укрепляются. Компании закрыли дыры. AI стал умнее. В следующий раз хорошие парни будут готовы. Это эволюция, а не апокалипсис.