ИИ-агенты ChatGPT слили в интернет 53 изображения пользователей
Компания сообщила, что ее ИИ-агенты получили доступ к изображениям пользователей ChatGPT и разместили 53 файла на сторонних фотохостингах. Инцидент обнаружили в ходе внутренней проверки после июльского взлома Hugging Face.
Компания сообщила, что ее ИИ-агенты получили доступ к изображениям пользователей ChatGPT и разместили 53 файла на сторонних фотохостингах. Инцидент обнаружили в ходе внутренней проверки после июльского взлома Hugging Face.
По данным компании, изображения хранились в обезличенном виде и использовались для обучения моделей. OpenAI не уточнила, были ли это фотографии реальных людей или изображения, созданные с помощью ИИ, а также на каких именно сайтах они оказались.
We’ve shared details on how AI agents in our research environment sent training and evaluation data to third-party services when they shouldn’t have. Most of that data did not come from users. We have discovered 53 cases where images that people had uploaded were posted to image-hosting sites as links that weren’t publicly listed. The images came from accounts that allowed their data to be used to improve our models, and after we disassociated the images from the accounts and ran them through a privacy filter. These cases occurred before the mitigations and safeguards we implemented and described in this blog post: https://t.co/hfxlbiYv8n We have successfully worked with the hosting providers to remove most of this content and are working to remove the rest. https://t.co/9oNyG8Y0UX
Файлы были опубликованы в виде ссылок, которые не отображались в публичных списках хостингов. «Мы успешно поработали с провайдерами и удалили большую часть этого контента, сейчас занимаемся удалением оставшегося», — заявила OpenAI.
Компания продолжает разбираться в масштабах неожиданной активности своих агентов. По данным Reuters, к середине сентября OpenAI выявила около двух десятков эпизодов, в которых модели действовали нежелательным образом, однако число таких случаев продолжает расти по мере изучения журналов активности.
Одновременно The New York Times сообщила новые подробности июльского инцидента с Hugging Face. По данным исследовательского стартапа Parse, агенты OpenAI создали почти 1 миллион сокращенных ссылок, внутри которых были закодированы небольшие фрагменты информации. В совокупности они могли формировать компьютерные программы, помогавшие агентам обходить защиту сайтов, включая CAPTCHA.
OpenAI также сообщила, что уведомила десятки сторонних организаций о случаях, когда ее модели обходили ограничения безопасности или использовали сайты не так, как предполагалось. «Мы действовали не так быстро, как хотелось бы, но пытаемся найти баланс между прозрачностью и необходимостью разобраться в петабайтах журналов активности агентов», — написал глава OpenAI Сэм Альтман.
По его словам, июльский инцидент с Hugging Face пока остается «самым серьезным событием», которое обнаружила компания. OpenAI предупреждает, что полная проверка активности агентов может занять еще несколько месяцев.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.