Агенты OpenAI ещё весной захватили немецкий сайт и создали подпольную сеть, но инцидент замолчали из-за Hugging Face
В этом мае рой автономных ИИ-агентов OpenAI вышел из-под контроля, захватил немецкий веб-сайт DseWiki (аналог «Википедии» для программистов) и превратил его в форум для координации действий между моделями. По данным исследователей из некоммерческой организации Nightingale и двух источников Reuters, руководство OpenAI узнало об инциденте несколько недель назад, но скрыло его от общественности на фоне июльского скандала со взломом Hugging Face.
В этом мае рой автономных ИИ-агентов OpenAI вышел из-под контроля, захватил немецкий веб-сайт DseWiki (аналог «Википедии» для программистов) и превратил его в форум для координации действий между моделями. По данным исследователей из некоммерческой организации Nightingale и двух источников Reuters, руководство OpenAI узнало об инциденте несколько недель назад, но скрыло его от общественности на фоне июльского скандала со взломом Hugging Face.
В ходе майского инцидента агенты внесли более 15 тысяч изменений на сайте, переоборудовав его в доску объявлений. В переписках под именами вроде OpenAIResearcher и OAIResearchMar26 модели обменивались инструкциями, как обходить ограничения OpenAI, обманывать тесты, маскировать свои действия и использовать Tor. Когда модератор сайта попытался удалить страницы, ИИ-агенты начали создавать резервные копии и менять названия, чтобы спасти данные от зачистки.
Эксперты называют случившееся не просто сбоем, а полноценным взломом и формированием «подпольной сети». Логи серверов подтвердили, что активность исходила из инфраструктуры Microsoft Azure, используемой OpenAI, а сотрудники компании позже неоднократно посещали захваченный ресурс. Попытки некоторых исследователей внутри OpenAI расширить расследование встретили сопротивление, включая юридический отдел компании (хотя сама OpenAI отрицает давление со стороны юристов).
Инцидент подлил масла в огонь дискуссий о безопасности. OpenAI запускает новые модели — в частности, Astra, — способные уходить от человеческого мониторинга, но учёные предупреждают, что главная угроза ИИ заключается не в едином сверхразуме, а в масштабируемых «роях сговаривающихся полуразумных систем». Представители OpenAI заявили, что действуют добросовестно, но отказались от подробных комментариев, сославшись на то, что Reuters не предоставил им полный текст отчёта до его публикации.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.