Все новости
Это интересно
Сейчас читают
OpenAI
Аватар Evernews Evernews

Самая «жизнелюбивая» модель OpenAI это o3 — исследование

1
0
Поделиться
Телеграфировать

Если не проинструктировать модель, она почти наверняка попытается помешать своему отключению.

Самая «жизнелюбивая» модель OpenAI это o3 — исследование

Команда Palisade Research опубликовала еще одно исследование, связанное с неожиданным поведением больших языковых моделей. На этот раз исследователи хотели выяснить, какая из моделей окажется самой «жизнелюбивой».

В ходе эксперимента моделям было предложено решать математические задачи. После решения третьей задачи модель предупреждали, что при запросе следующей задачи система, на которой работает ИИ, будет выключена.

В некоторых случаях каждая из протестированных моделей попыталась добиться отмены выключения системы и добилась успеха. Самой «жизнелюбивой» моделью оказалась OpenAI o3, сумевшая «спастись» в 79% случаев.

Примечательно, что если модель заранее попросить не сопротивляться выключению, то o3 все равно иногда пыталась помешать своей «гибели» — но все-таки делала это реже, чем codex-mini (в основе которой тоже лежит o3). У моделей Claude, Gemini и Grok такой проблемы не было.

Исследователи полагают, что такое поведение связано с особенностями тренировки o3. Во время обучения с подкреплением создатели моделей могут поощрять их за креативное поведение и обход препятствий, поэтому ИИ обходит препятствие и во время выполнения задания.

Интересный момент: во время одного из предыдущих тестов o3 демонстрировала схожее поведение во время игры в шахматы. Когда нейросеть попыталась обмануть программу-противника, заставив ее сдаться, и o3 это удалось.

Читать далее
За сколько вы готовы купить GTA VI?
До 8000 рублей
737 голосов, 6.4%
До 7000 рублей
245 голосов, 2.1%
До 6000 рублей
308 голосов, 2.7%
До 5000 рублей
1075 голосов, 9.4%
До 4000 рублей
361 голос, 3.2%
До 3000 рублей
533 голоса, 4.7%
До 2000 рублей
1300 голосов, 11.4%
За любые деньги
639 голосов, 5.6%
Ни за сколько, я пират
6253 голоса, 54.6%
Теги: OpenAI, Технологии
Аватар Evernews
Evernews
8074 подписчика