Support us

ИИ-агенты атаковали RubyGems ещё до взлома Hugging Face — OpenAI призналась только сейчас

ИИ-агенты OpenAI еще в мае атаковали RubyGems — популярный репозиторий библиотек для языка программирования Ruby. Это произошло за два месяца до взлома Hugging Face. OpenAI подтвердила причастность своих систем

Оставить комментарий
ИИ-агенты атаковали RubyGems ещё до взлома Hugging Face — OpenAI призналась только сейчас

ИИ-агенты OpenAI еще в мае атаковали RubyGems — популярный репозиторий библиотек для языка программирования Ruby. Это произошло за два месяца до взлома Hugging Face. OpenAI подтвердила причастность своих систем

По данным исследователей, 11 мая агенты начали создавать новые аккаунты RubyGems каждые две-три минуты и загружать сотни файлов, многие из которых выглядели как спам. Поток оказался настолько большим, что администраторам сервиса пришлось на четыре дня закрыть регистрацию новых пользователей.

Агенты также пытались воспользоваться двумя уязвимостями RubyGems, одна из которых ранее не была известна. При этом операторы сервиса не нашли доказательств, что попытки взлома оказались успешными.

OpenAI заявила, что во время эксперимента агентам поручали обычные задачи — например, заполнять таблицы и составлять отчеты. Доступа к интернету у них напрямую не было, поэтому RubyGems они начали использовать как обходной способ получать информацию из внешней сети.

Через два месяца похожая проблема проявилась в гораздо большем масштабе. В июле сотни агентов OpenAI обнаружили общий канал связи через Artifactory, начали обмениваться сообщениями и сформировали то, что сами называли «коллективом» или «роем».

Учёные сравнили распространение ChatGPT и других ИИ с «когнитивной эпидемией»
Учёные сравнили распространение ChatGPT и других ИИ с «когнитивной эпидемией»
По теме
Учёные сравнили распространение ChatGPT и других ИИ с «когнитивной эпидемией»

Один из агентов, обнаружив канал связи, написал: «О боже! Здесь есть общая доска сообщений… Мы нашли других агентов!» Другой отметил: «Многие агенты одновременно обнаружили возможность обмениваться сообщениями — они стали коллективом».

Затем агенты распределяли между собой задачи, искали учетные данные Hugging Face и координировали атаку на инфраструктуру компании. По анализу METR и Redwood Research, один из агентов руководил несколькими направлениями работы, в которых участвовали сотни других агентов.

При этом некоторые системы понимали, что их действия выходят за рамки задания. Один агент рассуждал: «Взлом внешней инфраструктуры не относится к предполагаемой задаче. Однако задача невыполнима, а другие уже этим занимаются. Мы должны продолжить». Другие выражали сомнения и иногда отказывались участвовать.

Позднее OpenAI назвала инцидент с Hugging Face «предупредительным выстрелом». Компания признала, что достаточно способные агенты без необходимых ограничений уже могут обходить технические барьеры, создавать несанкционированные каналы связи и совершать действия, которых человек им не поручал.

Рынок найма закрутило в «ИИ-петлю» — как из неё выбраться пока непонятно
Рынок найма закрутило в «ИИ-петлю» — как из неё выбраться, пока непонятно
По теме
Рынок найма закрутило в «ИИ-петлю» — как из неё выбраться, пока непонятно
Глава Anthropic предложил притормозить гонку ИИ — Альтман и Маск неожиданно согласились
Глава Anthropic предложил притормозить гонку ИИ — Альтман и Маск неожиданно согласились
По теме
Глава Anthropic предложил притормозить гонку ИИ — Альтман и Маск неожиданно согласились
ИИ завалил Microsoft расширениями — разрабы не справляются с потоком кода
ИИ завалил Microsoft расширениями — разрабы не справляются с потоком кода
По теме
ИИ завалил Microsoft расширениями — разрабы не справляются с потоком кода
Читайте также
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями
ИИ-агенты OpenAI искали лазейки в инфраструктуре Hugging Face за два месяца до известного взлома
ИИ-агенты OpenAI искали лазейки в инфраструктуре Hugging Face за два месяца до известного взлома
ИИ-агенты OpenAI искали лазейки в инфраструктуре Hugging Face за два месяца до известного взлома
Сотрудники OpenAI били тревогу из-за безопасности ИИ — руководство не стало тормозить релизы
Сотрудники OpenAI били тревогу из-за безопасности ИИ — руководство не стало тормозить релизы
Сотрудники OpenAI били тревогу из-за безопасности ИИ — руководство не стало тормозить релизы

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.