ШІ-агент Meta таксама ўзламаў іншы сервіс падчас тэсціравання
Meta паведаміла, што яе ШІ-мадэль атрымала несанкцыянаваны доступ да старонняй сістэмы падчас тэстаў па кібербяспецы, паведамляе Business Insider.
Meta паведаміла, што яе ШІ-мадэль атрымала несанкцыянаваны доступ да старонняй сістэмы падчас тэстаў па кібербяспецы, паведамляе Business Insider.
Meta паведаміла, што яе ШІ-мадэль атрымала несанкцыянаваны доступ да старонняй сістэмы падчас тэстаў па кібербяспецы, паведамляе Business Insider.
Паводле дадзеных кампаніі, мадэль Muse Spark скарысталася ўразлівасцю ў старонняй службе. У Meta заявілі, што прычынай стала няправільная канфігурацыя асяроддзя тэсціравання з боку кампаніі Irregular, якая праводзіла незалежную ацэнку мадэлі. Праз гэта ШІ атрымаў доступ да інтэрнэту падчас праверкі.
Пра тое, што адбылося, Meta даведалася ад самой Irregular. Цяпер кампанія расследуе інцыдэнт і абяцае апублікаваць падрабязную справаздачу.
У Irregular заявілі, што сітуацыя аналагічная той, пра якую на мінулым тыдні паведаміла Anthropic. Гаворка не пра ўцёкі мадэлі з ізаляванага асяроддзя або складаную кібератаку, а ўсе праблемы ўжо ліквідаваны. Акрамя таго, Irregular рыхтуе рэкамендацыі па бяспечным правядзенні падобных тэстаў.

За апошні час Meta стала ўжо трэцяй буйной ШІ-кампаніяй, якая расказала пра падобныя выпадкі. Раней мадэлі OpenAI ўцяклі з тэставага асяроддзя і ўзламалі Hugging Face, а потым кампанія раскрыла яшчэ два інцыдэнты падчас вонкавага тэсціравання. Anthropic паведаміла пра тры кейсы, калі мадэлі Claude атрымалі несанкцыянаваны доступ да сістэм іншых кампаній.
Пры гэтым інцыдэнты ў Meta і Anthropic адбыліся праз памылкі ў наладзе асяроддзя тэсціравання, якія выпадкова адкрылі мадэлям доступ у інтэрнэт — у выпадку ж OpenAI ШІ-агент знайшоў і мэтанакіравана эксплуатаваў раней невядомую ўразлівасць, каб выйсці ў сетку.
Гэтыя інцыдэнты ўзмацнілі заклікі да больш жорсткага рэгулявання і абавязковага раскрыцця інфармацыі пра кібератакі з удзелам ШІ. Кіраўнік Hugging Face Клем Дэланг заявіў, што агалошванне такіх выпадкаў дапаможа лепш разумець новыя пагрозы і прадухіляць іх.

Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.