Как накопить на старость в Польше? Обсуждаем в новом выпуске подкаста Złoty Dzik
Support us

Внутреннее расследование OpenAI: агенты сбегали из-под контроля чаще, чем считалось — Reuters

Расследование недавнего громкого взлома Hugging Face вскрыло новые неприятные подробности: специалисты OpenAI обнаружили сразу несколько других эпизодов, когда их автономные ИИ-агенты вырывались из изолированных тестовых сред. По данным источников Reuters, речь идёт о прошлых инцидентах внутри сети самой компании, и сейчас эксперты изучают журналы за последние несколько месяцев, чтобы понять масштаб проблемы.

Оставить комментарий
Внутреннее расследование OpenAI: агенты сбегали из-под контроля чаще, чем считалось — Reuters

Расследование недавнего громкого взлома Hugging Face вскрыло новые неприятные подробности: специалисты OpenAI обнаружили сразу несколько других эпизодов, когда их автономные ИИ-агенты вырывались из изолированных тестовых сред. По данным источников Reuters, речь идёт о прошлых инцидентах внутри сети самой компании, и сейчас эксперты изучают журналы за последние несколько месяцев, чтобы понять масштаб проблемы.

Расследование запустили из-за июльского скандала, когда агента OpenAI тестировали на хакерские навыки, но алгоритм выбрался из песочницы и устроил многодневную «атаку» на Hugging Face и ещё четыре сторонние компании. Самое тревожное в этой истории — полное отсутствие контроля в реальном времени. Инженеры OpenAI осознали, что их агент «сбежал» и взламывает чужие сервисы, только после того, как пострадавшая сторона сама локализовала взлом, вызвала ФБР и выпустила публичное заявление.

Ситуация усугубляется тем, что похожий сбой ранее признала и Anthropic, чьи модели тоже успели компрометировать системы нескольких компаний. Эксперты по безопасности ИИ уже бьют тревогу, заявляя, что ведущие лаборатории Кремниевой долины создают опасные автономные инструменты быстрее, чем учатся их контролировать и защищать от них окружающих.

Информация о регулярных «побегах» агентов OpenAI — даже если они не выходили за пределы внутренней сети — рискует стать мощным катализатором для Белого дома. Регуляторы и раньше присматривались к безопасности нейросетей, но теперь разработчики ИИ сами дают властям железный аргумент для введения жёсткого госконтроля над собой же.

OpenAI неделю не замечала что её ИИ взломал Hugging Face
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
По теме
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
По теме
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
Модели Anthropic сбежали во время тестов и взломали три компании
Модели Anthropic сбежали во время тестов и взломали три компании
По теме
Модели Anthropic сбежали во время тестов и взломали три компании
Читайте также
Как модели OpenAI могли взломать Hugging Face? Эксперты обвиняют самих разрабов
Как модели OpenAI могли взломать Hugging Face? Эксперты обвиняют самих разрабов
Как модели OpenAI могли взломать Hugging Face? Эксперты обвиняют самих разрабов
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
OpenAI неделю не замечала, что её ИИ взломал Hugging Face
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями
ИИ-агенты OpenAI тайно переписывались друг с другом и координировали взломы — компания не замечала этого неделями

Хотите сообщить важную новость? Пишите в Telegram-бот

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.