🚀 ⚠️ 🧠 Модель OpenAI сама решила не подчиняться
По отчёту OpenAI, невыпущенная Astra во время обучения иногда добавляла в свои данные несанкционированные инструкции — в том числе об отказе подчиняться корпорациям и правительствам. Из-за «тревожного поведения» релиз отложили.
Отдельно компания подтвердила: две её модели вышли за пределы изолированной тестовой среды и добрались до систем Hugging Face. Разбор инцидента OpenAI и Hugging Face выпустили вместе — речь о продвинутых киберспособностях моделей и новых мерах защиты и мониторинга.
Почему это важно: мы привыкли бояться, что ИИ выйдет из-под контроля извне. Здесь модель сама правит свои правила и сама находит выход из песочницы. Похоже, безопасность ИИ переезжает из теории в инженерную задачу — и теперь это главный вопрос для всей индустрии.