Полезные ссылки

OpenAI 26.05.2025 в 14:57

Самая «жизнелюбивая» модель OpenAI это o3 — исследование

Если не проинструктировать модель, она почти наверняка попытается помешать своему отключению.

Команда Palisade Research опубликовала еще одно исследование, связанное с неожиданным поведением больших языковых моделей. На этот раз исследователи хотели выяснить, какая из моделей окажется самой «жизнелюбивой».

В ходе эксперимента моделям было предложено решать математические задачи. После решения третьей задачи модель предупреждали, что при запросе следующей задачи система, на которой работает ИИ, будет выключена.

В некоторых случаях каждая из протестированных моделей попыталась добиться отмены выключения системы и добилась успеха. Самой «жизнелюбивой» моделью оказалась OpenAI o3, сумевшая «спастись» в 79% случаев.

Примечательно, что если модель заранее попросить не сопротивляться выключению, то o3 все равно иногда пыталась помешать своей «гибели» — но все-таки делала это реже, чем codex-mini (в основе которой тоже лежит o3). У моделей Claude, Gemini и Grok такой проблемы не было.

Исследователи полагают, что такое поведение связано с особенностями тренировки o3. Во время обучения с подкреплением создатели моделей могут поощрять их за креативное поведение и обход препятствий, поэтому ИИ обходит препятствие и во время выполнения задания.

Интересный момент: во время одного из предыдущих тестов o3 демонстрировала схожее поведение во время игры в шахматы. Когда нейросеть попыталась обмануть программу-противника, заставив ее сдаться, и o3 это удалось.

Уже пробовали взлом Denuvo через гипервизор?

Да, работает

419 голосов, 25.8%

Да, не заработало

141 голос, 8.7%

Нет, страшновато

584 голоса, 35.9%

Лучше купить аккаунт

234 голоса, 14.4%

Только лицензии, только хардкор

249 голосов, 15.3%

Теги: OpenAI, Технологии

Evernews

8090 подписчиков

Подписаться на автора

Подписывайтесь на WTFTime в Google.Новости