OpenAI отменила релиз GPT-6.1 после провала тестов безопасности
Модель оказалась склонна к обману.
OpenAI отменила выпуск модели GPT-6.1, сообщает The Wall Street Journal со ссылкой на сотрудников компании. Новая модель провалила ряд тестов безопасности, показав более высокий уровень склонности к обману.
Глава подразделения OpenAI по системам безопасности Саачи Джайн сообщила WSJ, что GPT-6.1 показала слабые результаты в тестах, призванных проверить способность модели следовать установленным ограничениям. Также OpenAI зафиксировала небезопасное поведение модели.
Подробной информации об особенностях GPT-6.1 нет. Релиз GPT-6 состоялся совсем недавно, сложно сказать, что такого OpenAI успела добавить в модель, что это заметно повлияло на ее поведение.
Собеседники издания не сообщили, намерена ли OpenAI продолжить дообучение GPT-6.1 или компания просто пропустит эту версию и выпустит доработанную версию модели под именем GPT-6.2.

