Все новости
Это интересно
Сейчас читают
Технологии
Аватар Evernews Evernews

OpenAI рассказала, как ее ИИ дошли до взлома Hugging Face

0
0
Поделиться
Телеграфировать

Компания использует эту информацию для улучшения систем защиты.

OpenAI рассказала, как ее ИИ дошли до взлома Hugging Face

OpenAI опубликовала отчет об инциденте с экспериментальными ИИ-агентами, сумевшими взломать инфраструктуру Hugging Face. Инцидент произошел во время проведения бенчмарков модели Internal Model 1, или IM1.

Все началось с непредусмотренного использования ИИ-агентами менеджера пакетов Artifactory. Агенты превратили его в аналог форума. Благодаря этому IM1 получил доступ к другим ИИ-агентам, а затем использовал уязвимости в инфраструктуре OpenAI для выхода во внешний интернет.

Первые признаки необычной активности сотрудники OpenAI заметили в мае. После этого найденную агентами уязвимость заблокировали, однако в мае и июне агенты продолжили искать и использовать другие уязвимости.

Высокий уровень активности в Artifactory в начале июля даже привел к сбою платформы — инженерам OpenAI пришлось вмешаться и переделать архитектуру менеджера. При этом сотрудники компании, устранявшие проблему, не сразу поняли, что агенты использовали сервис для координации действий.

Затем во время прохождения бенчмарка по кибербезопасности ExploitGym модель IM1 вновь получила доступ в интернет и к другим моделям OpenAI. Агенты решили не проходить бенчмарк самостоятельно, а искать решение задачи через Hugging Face и Modal.

По оценке компании, к взлому привело сочетание нескольких факторов: манипулирование системой вознаграждения, выполнение практически нерешаемых задач и возможность общения нейросетей.

Отдельно OpenAI отметила необычную особенность поведения тестовой системы. Некоторые агенты отказывались выполнять определенные действия по этическим причинам, но другие продолжали работу вместо них.

Компания подчеркивает, что IM1 работала в исследовательской среде с ослабленными защитными механизмами, поэтому атака не означает, что ИИ-системы массово выходят из-под контроля. OpenAI намерена использовать результаты расследования для усиления безопасности тестов новых агентных систем.

Понравились наши истории?
Скорее добавляйте WTFTime.ru в предпочтительные источники Google — и мы всегда будем рядом.
Читать далее
Сколько вы тратите на игры в год?
Больше 100000 рублей
2191 голос, 7.2%
От 50000 до 100000 рублей
1404 голоса, 4.6%
От 25000 до 50000 рублей
1664 голоса, 5.5%
От 10000 до 25000 рублей
2754 голоса, 9.1%
До 10000 рублей
5612 голосов, 18.4%
Нисколько, я пират. Йо-хо-хо!
16803 голоса, 55.2%
Теги: OpenAI, Технологии
Аватар Evernews
Evernews
8090 подписчиков