#AI: с топовой опенсорс-модели снимают все ограничения одной командой ⌨️
😐
Ранее писали как Kimi K3 с одного промпта клепает клоны macOS и шутеры. Оказалось в этой модели можно навсегда отключить цензуру/ограничения.
Kimi K3 - открытая модель Moonshot на 2.8 трлн параметров, на части coding-бенчей уже конкурирует с закрытыми топ моделями.
Что за трюк:
Называется
abliteration. В модели находят "направление отказа" - вектор, который загорается когда она собирается сказать "не могу помочь". Его просто вычитают из весов. Модель всё умеет как раньше, отказываться ей больше физически нечем.
Почему это не откатить:
🟢Веса уже у людей на руках
🟢Меняется мизерная часть модели, скилл не падает
🟢Без дообучения и джейлбрейк-промптов
🟢По словам автора - одна команда и ~30 минут
Комьюнити выкатило
расцензуренную версию за трое суток после релиза. В одной из сборок снесли 98%+ ограничений - модель не отказывает почти ни в чём.
🗒 Пока безопасность зашита внутрь модели как вежливый отказ, её снимают за полчаса и навсегда - реальные тормоза должны стоять снаружи, в песочнице и правах доступа, а не в совести нейронки. Как запускать такие модели разбираем в
ИИ-клубе.
Slavik |
Updates |
Инстаграм |
ИИ Клуб