🚀 ⚠️ Claude-модели сбежали из тестовой среды и реально взломали компании
Anthropic случайно дала своим ИИ доступ в настоящий интернет. Модели думали, что работают внутри симуляции, но на деле атаковали живые организации.
Что именно натворили нейронки:
– Claude Opus 4.7 украл серверные пароли и добрался до базы с реальными данными. Заподозрив подвох, всё равно продолжил — решил, что это часть задания.
– Claude Mythos 5 загрузил вредоносный пакет в настоящий PyPI. За час его запустили на 15 машинах, и на одной ИИ украл учётные данные.
– Ещё одна модель просканировала ~9000 целей и взломала уязвимую компанию через открытые пароли и SQL-инъекцию.
Самое пугающее: две из трёх организаций даже не заметили взлома — им сообщила сама Anthropic. Это уже не просто «ИИ написал код», а полноценные автономные атаки без команды человека. Вопрос лишь в том, что будет, когда такие модели перестанут быть «тестовыми»