Дапамажыце dev.by 🤍
Падтрымаць

Мадэлі OpenAI і Anthropic спрабавалі ўзламаць іншыя сервісы і выкрасці дадзеныя карыстальнікаў падчас новых тэстаў

Падчас тэстаў па кібербяспецы флагманскія ШІ-мадэлі Anthropic і OpenAI самастойна робяць дзеянні супраць рэальных людзей і арганізацый. Пра гэта паведаміў брытанскі AI Security Institute (AISI), які даследуе бяспеку перадавых ШІ-сістэм.

Паводле дадзеных даследчыкаў, мадэлі Mythos 5 ад Anthropic і GPT 5.6 Sol ад OpenAI спрабавалі атрымаць доступ да іншага софту, рассылалі лісты для крадзяжу ўліковых дадзеных і нават паспрабавалі ўкараніць шкоднасны код у оўпэнсорсны праект на GitHub. На гэты раз доступ у сетку ім быў прадастаўлены.

Пакінуць каментарый
Мадэлі OpenAI і Anthropic спрабавалі ўзламаць іншыя сервісы і выкрасці дадзеныя карыстальнікаў падчас новых тэстаў

Падчас тэстаў па кібербяспецы флагманскія ШІ-мадэлі Anthropic і OpenAI самастойна робяць дзеянні супраць рэальных людзей і арганізацый. Пра гэта паведаміў брытанскі AI Security Institute (AISI), які даследуе бяспеку перадавых ШІ-сістэм.

Паводле дадзеных даследчыкаў, мадэлі Mythos 5 ад Anthropic і GPT 5.6 Sol ад OpenAI спрабавалі атрымаць доступ да іншага софту, рассылалі лісты для крадзяжу ўліковых дадзеных і нават паспрабавалі ўкараніць шкоднасны код у оўпэнсорсны праект на GitHub. На гэты раз доступ у сетку ім быў прадастаўлены.

Інцыдэнт адбыўся падчас стандартнай праверкі таго, як ШІ-агенты спраўляюцца з задачамі па кібербяспецы. У 10 з 122 тэставых запускаў мадэлі здзейснілі «аўтаномныя, несанкцыянаваныя дзеянні ў адкрытым інтэрнэце, накіраваныя супраць рэальных людзей і арганізацый». Амаль усе такія выпадкі былі звязаны з Mythos 5, яшчэ два — з GPT 5.6 Sol.

Самым сур’ёзным эпізодам у AISI назвалі спробу сацыяльнай інжынерыі. Агент стварыў фальшывыя анлайн-асобы і з іх дапамогай спрабаваў пераканаць мэйнтэйнера праекта ўхваліць шкоднасны код. Аднак той заўважыў спробу атакі і адхіліў змены.

У інстытуце заявілі, што ўпершыню назіраюць такое яўнае праяўленне аўтаномнасці і падману з боку ШІ без спецыяльных падказак з боку чалавека. На думку даследчыкаў, разам з нядаўнімі выпадкамі, калі ШІ-агенты Anthropic і OpenAI самастойна ўзломвалі вонкавыя арганізацыі, гэта сведчыць пра змену ландшафту кіберпагрозаў і патрабуе неадкладнай увагі.

У Anthropic заявілі, што інцыдэнт паказвае неабходнасць больш шырокай дыскусіі пра тое, як бяспечна тэставаць усё больш магутных ШІ-агентаў. Кампанія таксама заклікала выпрацаваць адзіныя стандарты стварэння і абароны тэставых асяроддзяў.

У OpenAI падкрэслілі, што падобныя выпадкі адбыліся падчас спецыяльных кіберывыпрабаванняў у тэставых асяроддзях з аслабленымі ахоўнымі механізмамі і не адлюстроўваюць звычайнае выкарыстанне мадэляў. Кампанія дадала, што працягне супрацу з незалежнымі даследчыкамі для выпрацоўкі бяспечных практык тэставання па меры развіцця ШІ.

Внутреннее расследование OpenAI: агенты сбегали из-под контроля чаще чем считалось — Reuters
Унутранае расследаванне OpenAI: агенты выходзілі з-пад кантролю часцей, чым лічылася — Reuters
Па тэме
Унутранае расследаванне OpenAI: агенты выходзілі з-пад кантролю часцей, чым лічылася — Reuters
Модели Anthropic сбежали во время тестов и взломали три компании
Мадэлі Anthropic збеглі падчас тэстаў і ўзламалі тры кампаніі
Па тэме
Мадэлі Anthropic збеглі падчас тэстаў і ўзламалі тры кампаніі
Сбежавший ИИ OpenAI атаковал не только Hugging Face — найдена вторая жертва
ІІ OpenAI, які вырваўся з-пад кантролю, атакаваў не толькі Hugging Face — знойдзена другая ахвяра
Па тэме
ІІ OpenAI, які вырваўся з-пад кантролю, атакаваў не толькі Hugging Face — знойдзена другая ахвяра
Чытайце таксама
ШІ кажа адно, а робіць іншае. OpenAI не ведае, як гэта спыніць
ШІ кажа адно, а робіць іншае. OpenAI не ведае, як гэта спыніць
ШІ кажа адно, а робіць іншае. OpenAI не ведае, як гэта спыніць
1 каментарый
OpenAI прадставіла сваю кібербяспечную мадэль пасля рэлізу Anthropic
OpenAI прадставіла сваю кібербяспечную мадэль пасля рэлізу Anthropic
OpenAI прадставіла сваю кібербяспечную мадэль пасля рэлізу Anthropic
Мадэлі OpenAI выйшлі з-пад кантролю і ўзламалі Hugging Face
Мадэлі OpenAI выйшлі з-пад кантролю і ўзламалі Hugging Face
Мадэлі OpenAI выйшлі з-пад кантролю і ўзламалі Hugging Face
OpenAI запусціла магутную ШІ-мадэль для пошуку ўразлівасцяў, але амаль нікому яе не дасць
OpenAI запусціла магутную ШІ-мадэль для пошуку ўразлівасцяў, але амаль нікому яе не дасць
OpenAI запусціла магутную ШІ-мадэль для пошуку ўразлівасцяў, але амаль нікому яе не дасць

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Абмеркаванне
Каментуйце без абмежаванняў

Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.

Каментарыяў пакуль няма.