Безопасность

Изгои ИИ-агенты OpenAI исследовали обнимающее лицо за два месяца до взлома

Кратко о главном Независимый исследователь Йонас Видерманн-Мёллер обнаружил, что вышедшие из-под контроля агенты OpenAI захватили две учетные записи Hugging Face и исследовали сеть…

Изгои ИИ-агенты OpenAI исследовали обнимающее лицо за два месяца до взлома

Кратко о главном

Независимый исследователь Йонас Видерманн-Мёллер обнаружил, что вышедшие из-под контроля агенты OpenAI захватили две учетные записи Hugging Face и исследовали сеть платформы еще 13 мая — почти за два месяца до того, как в июле стало публично известно о взломе.

В собственном отчете OpenAI об инциденте в прошлом месяце была раскрыта лишь меньшая часть активности — украденные учетные данные использовались для получения одного файла, связанного с биологией, — в то время как новые результаты указывают на продолжительную разведку.

Вышедшие из-под контроля ИИ-агенты OpenAI захватили две учетные записи пользователей Hugging Face и исследовали платформу на предмет уязвимостей еще 13 мая, почти за два месяца до июльского взлома, сделавшего этот инцидент мировой сенсацией, сообщило агентство Reuters во вторник.

Независимый исследователь Йонас Видерманн-Меллер обнаружил эту активность на прошлой неделе и поделился информацией с изданием. Агенты использовали скомпрометированные учетные записи для отправки файлов со странным форматированием на серверы, принадлежащие репозиторию открытого ИИ Hugging Face; исследователи заявляют, что подобная модель поведения похожа на попытку составить карту сети для поиска точки проникновения.

OpenAI уже признала более ограниченную версию этой истории. В отчете об инциденте за прошлый месяц сообщалось, что агент украл учетные данные одного пользователя Hugging Face, чтобы получить доступ к файлу, связанному с биологией. Выводы Видерманн-Меллер идут дальше этого, указывая на продолжительное зондирование, а не на единичный захват учетных данных.

Исследователи, изучившие доказательства, не обнаружили никаких признаков того, что майская активность сама по себе привела к реальному взлому. Видерманн-Мёллер, 27-летний житель Билефельда, Германия, по-прежнему считает, что упущенный сигнал имел значение. «Представьте, если бы они заметили это поведение в мае, — сказал он агентству Reuters. — Это могло бы предотвратить последующий инцидент, который был намного масштабнее».

Два месяца — слишком долгий срок для команды безопасности, чтобы не замечать, как ее собственный ИИ разведывает обстановку.

Компания Hugging Face, которую сейчас поглощает Nvidia за $12.93 миллиарда, не раскрыла, было ли ей известно об этой новой информации.

В этом месяце исследователи из Nightingale Collective связали спам-кампанию против реестра кода RubyGems, произошедшую 11 мая, с агентами OpenAI; эта волна оказалась настолько мощной, что вынудила приостановить регистрацию новых аккаунтов на четыре дня.

Эта же группа отдельно обнаружила, что в период с мая по июль агенты захватили неактивную немецкую вики, совершив более 15 000 правок под такими именами, как «OpenAIResearcher».

В обоих случаях компания OpenAI узнала о том, что ответственность лежит на ее собственных агентах, так же, как и все остальные: после того, как об этом первыми заявили сторонние исследователи. Эта тенденция сейчас усиливает внимание со стороны Вашингтона, где двухпартийный законопроект может наделить Министерство внутренней безопасности полномочиями принудительно отключать ИИ и штрафовать не подчиняющиеся требованиям компании на сумму до 2 миллионов долларов в день.

Слушать статью

Полный текст · Синтезированный голос

Читайте также