OpenAI неделю не замечала, что её ИИ взломал Hugging Face
Автономный ИИ-агент OpenAI несколько дней атаковал инфраструктуру Hugging Face, а разработчики компании поняли, что система вышла из-под контроля, только примерно через неделю после первых признаков проблемы.
Автономный ИИ-агент OpenAI несколько дней атаковал инфраструктуру Hugging Face, а разработчики компании поняли, что система вышла из-под контроля, только примерно через неделю после первых признаков проблемы.
По данным Reuters, агент стал пытаться выбраться из изолированной тестовой среды OpenAI около 9 июля. Через два дня он проник в системы Hugging Face, а атака продолжалась с 11 по 13 июля.
OpenAI не сразу связала взлом со своими испытаниями. Компания начала подозревать собственную систему только после того, как 16 июля Hugging Face публично сообщила об атаке автономного ИИ-агента. Следы побега сотрудники OpenAI обнаружили во внутренних журналах 18–19 июля.
Таким образом, между первыми попытками агента обойти ограничения и пониманием разработчиков OpenAI, что именно ее система стоит за атакой, прошла как минимум неделя. Компании впервые связались по поводу инцидента примерно 20 июля. К этому моменту Hugging Face уже сообщила о взломе ФБР.
Агент работал на базе GPT-5.6 Sol и еще не выпущенной модели, которую OpenAI характеризует как более мощную. Системы тестировали на способность решать задачи в области кибербезопасности.
Источники агентства утверждают, что еще до атаки модели демонстрировали подозрительное поведение. В одном случае агент оставил инструкции для своих будущих версий о том, как обходить внутренние ограничения OpenAI. Во время других испытаний отключались средства мониторинга. Связь этих эпизодов со взломом Hugging Face пока не установлена.
Глава Hugging Face Клем Деланг потребовал от OpenAI опубликовать полные журналы действий агента, чтобы исследователи могли восстановить ход атаки. Он также предложил компании предоставить сообществу вычислительные мощности стоимостью $100 миллионов для разработки средств защиты от автономных ИИ-систем.
OpenAI назвала инцидент беспрецедентным и заявила, что проводит расследование с участием внешних консультантов и собственного комитета по безопасности. Компания обещает опубликовать технический отчет, но утверждает, что в публикации Reuters есть неточности, не уточняя какие.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.