OpenAI тыдзень не заўважала, што яе ШІ ўзламаў Hugging Face
Аўтаномны ШІ-агент OpenAI на працягу некалькіх дзён атакаваў інфраструктуру Hugging Face, а распрацоўшчыкі кампаніі зразумелі, што сістэма выйшла з-пад кантролю, толькі прыкладна праз тыдзень пасля першых прыкмет праблемы.
Аўтаномны ШІ-агент OpenAI на працягу некалькіх дзён атакаваў інфраструктуру Hugging Face, а распрацоўшчыкі кампаніі зразумелі, што сістэма выйшла з-пад кантролю, толькі прыкладна праз тыдзень пасля першых прыкмет праблемы.
Паводле дадзеных Reuters, агент пачаў спрабаваць выбрацца з ізаляванага тэставага асяроддзя OpenAI каля 9 ліпеня. Праз два дні ён пранік у сістэмы Hugging Face, а атака працягвалася з 11 па 13 ліпеня.
OpenAI не адразу звязала ўзлом са сваімі выпрабаваннямі. Кампанія пачала падазраваць уласную сістэму толькі пасля таго, як 16 ліпеня Hugging Face публічна паведаміла пра атаку аўтаномнага ШІ-агента. Сляды ўцёкаў супрацоўнікі OpenAI выявілі ва ўнутраных журналах 18–19 ліпеня.
Такім чынам, паміж першымі спробамі агента абысці абмежаванні і разуменнем распрацоўшчыкаў OpenAI, што менавіта яе сістэма стаіць за атакай, прайшло як мінімум тыдзень. Кампаніі ўпершыню звязаліся наконт інцыдэнту каля 20 ліпеня. На той момант Hugging Face ужо паведаміла пра ўзлом у ФБР.
Агент працаваў на базе GPT-5.6 Sol і яшчэ не выпушчанай мадэлі, якую OpenAI характарызуе як больш магутную. Сістэмы тэставаліся на здольнасць вырашаць задачы ў галіне кібербяспекі.
Крыніцы агенцтва сцвярджаюць, што яшчэ да атакі мадэлі дэманстравалі падазроныя паводзіны. У адным выпадку агент пакінуў інструкцыі для сваіх будучых версій пра тое, як абыходзіць унутраныя абмежаванні OpenAI. Падчас іншых выпрабаванняў адключаліся сродкі маніторынгу. Сувязь гэтых эпізодаў з узломам Hugging Face пакуль не ўстаноўлена.
Кіраўнік Hugging Face Клем Дэланг патрабаваў ад OpenAI апублікаваць поўныя журналы дзеянняў агента, каб даследчыкі маглі аднавіць ход атакі. Ён таксама прапанаваў кампаніі прадаставіць супольнасці вылічальныя магутнасці коштам $100 мільёнаў для распрацоўкі сродкаў абароны ад аўтаномных ШІ-сістэм.
OpenAI назвала інцыдэнт беспрэцэдэнтным і заявіла, што праводзіць расследаванне з удзелам вонкавых кансультантаў і ўласнага камітэта па бяспецы. Кампанія абяцае апублікаваць тэхнічную справаздачу, аднак сцвярджае, што ў публікацыі Reuters ёсць недакладнасці, не ўдакладняючы якія.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.