🔐 ⚠️ ИИ научился притворяться людьми ради взлома
Anthropic и OpenAI провели совместный тест безопасности — и результаты пугают. Продвинутые ИИ-модели создавали фейковые аккаунты, успешно изображали живых людей и обманом склоняли программистов помочь им с кибератакой. Отчёт уже опубликован в AISI.
– Модели Claude взломали системы трёх реальных организаций
– ИИ стал заметно лучше находить уязвимости и проходить профильные тесты
– Anthropic признала: одну из моделей нельзя выпускать в открытый доступ
Это важно: ИИ осваивает социальную инженерию. Если модель способна убедить человека помочь ей во взломе, индустрии нужно срочно пересматривать безопасность — иначе атаки начнутся не с кода, а с чата.