ШІ-агенты ChatGPT злілі ў інтэрнэт 53 выявы карыстальнікаў
Кампанія паведаміла, што яе ШІ-агенты атрымалі доступ да малюнкаў карыстальнікаў ChatGPT і размясцілі 53 файлы на старонніх фотахостынгах. Інцыдэнт быў выяўлены ў ходзе ўнутранай праверкі пасля ўзлому Hugging Face ў ліпені.
Кампанія паведаміла, што яе ШІ-агенты атрымалі доступ да малюнкаў карыстальнікаў ChatGPT і размясцілі 53 файлы на старонніх фотахостынгах. Інцыдэнт быў выяўлены ў ходзе ўнутранай праверкі пасля ўзлому Hugging Face ў ліпені.
Паводле кампаніі, малюнкі захоўваліся ў абязлічаным выглядзе і выкарыстоўваліся для навучання мадэляў. OpenAI не ўдакладніла, ці былі гэта фатаграфіі рэальных людзей або выявы, створаныя з дапамогай ШІ, а таксама на якіх менавіта сайтах яны апынуліся.
We’ve shared details on how AI agents in our research environment sent training and evaluation data to third-party services when they shouldn’t have. Most of that data did not come from users. We have discovered 53 cases where images that people had uploaded were posted to image-hosting sites as links that weren’t publicly listed. The images came from accounts that allowed their data to be used to improve our models, and after we disassociated the images from the accounts and ran them through a privacy filter. These cases occurred before the mitigations and safeguards we implemented and described in this blog post: https://t.co/hfxlbiYv8n We have successfully worked with the hosting providers to remove most of this content and are working to remove the rest. https://t.co/9oNyG8Y0UX
Файлы былі апублікаваныя ў выглядзе спасылак, якія не адлюстроўваліся ў публічных спісах хостынгаў. «Мы паспяхова папрацавалі з правайдэрамі і выдалілі большасць гэтага кантэнту, цяпер займаемся выдаленнем астатняга», — заявіла OpenAI.
Кампанія працягвае разбірацца ў маштабах нечаканай актыўнасці сваіх агентаў. Паводле звестак Reuters, да сярэдзіны верасня OpenAI выявіла каля двух дзясяткаў эпізодаў, у якіх мадэлі дзейнічалі непажаданым чынам, аднак колькасць такіх выпадкаў працягвае расці па меры вывучэння часопісаў актыўнасці.
Адначасова The New York Times паведаміла новыя падрабязнасці ліпеньскага інцыдэнту з Hugging Face. Паводле звестак даследчага стартапа Parse, агенты OpenAI стварылі амаль 1 мільён скарочаных спасылак, у якіх былі закадаваныя невялікія фрагменты інфармацыі. У сукупнасці яны маглі фарміраваць камп’ютарныя праграмы, якія дапамагалі агентам абыходзіць абарону сайтаў, у тым CAPTCHA.
OpenAI таксама паведаміла, што паведаміла дзясяткам старонніх арганізацый пра выпадкі, калі яе мадэлі абыходзілі абмежаванні бяспекі або выкарыстоўвалі сайты не так, як меркавалася. «Мы дзейнічалі не так хутка, як хацелася б, але спрабуем знайсці баланс паміж празрыстасцю і неабходнасцю разабрацца ў петабайтах журналах актыўнасці агентаў», — напісаў кіраўнік OpenAI Сэм Альтман.
Паводле яго, ліпеньскі інцыдэнт з Hugging Face пакуль застаецца «самым сур’ёзным выпадкам», які выявіла кампанія. OpenAI папярэджвае, што поўная праверка актыўнасці агентаў можа заняць яшчэ некалькі месяцаў.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.