Унутранае расследаванне OpenAI: агенты ўцякалі з-пад кантролю часцей, чым лічылася лічылі Reuters
Расследаванне нядаўняга гучнага ўзлому Hugging Face выявіла новыя непрыемныя падрабязнасці: спецыялісты OpenAI выявілі адразу некалькі іншых эпізодаў, калі іх аўтаномныя ШІ-агенты вырываліся з ізаляваных тэставых асяроддзяў. Паводле крыніц Reuters, гаворка ідзе пра мінулыя інцыдэнты ўнутры сеткі самой кампаніі, і цяпер эксперты вывучаюць журналы за апошнія некалькі месяцаў, каб зразумець маштаб праблемы.
Расследаванне нядаўняга гучнага ўзлому Hugging Face выявіла новыя непрыемныя падрабязнасці: спецыялісты OpenAI выявілі адразу некалькі іншых эпізодаў, калі іх аўтаномныя ШІ-агенты вырываліся з ізаляваных тэставых асяроддзяў. Паводле крыніц Reuters, гаворка ідзе пра мінулыя інцыдэнты ўнутры сеткі самой кампаніі, і цяпер эксперты вывучаюць журналы за апошнія некалькі месяцаў, каб зразумець маштаб праблемы.
Расследаванне запусцілі праз ліпеньскі скандал, калі агента OpenAI тэставалі на хакерскія навыкі, аднак алгарытм выбраўся з пясочніцы і зрабіў шматдзённую «атаку» на Hugging Face і яшчэ чатыры старонніх кампаніі. Самае трывожнае ў гэтай гісторыі — поўная адсутнасць кантролю ў рэальным часе. Інжынеры OpenAI ўсвядомілі, што іх агент «збег» і ўзломвае чужыя сервісы, толькі пасля таго, як пацярпелы бок сам лакалізаваў узлом, выклікаў ФБР і выпусціў публічную заяву.
Сітуацыя ўскладняецца тым, што падобны збой раней прызнала і Anthropic, чые мадэлі таксама паспелі скампраметаваць сістэмы некалькіх кампаній. Эксперты па бяспецы ШІ ўжо б’юць трывогу, заяўляючы, што вядучыя лабараторыі Крэмніевай даліны ствараюць небяспечныя аўтаномныя інструменты хутчэй, чым вучацца іх кантраляваць і абараняць ад іх навакольных.
Інфармацыя пра рэгулярныя «ўцёкі» агентаў OpenAI — нават калі яны не выходзілі за межы ўнутранай сеткі — рызыкуе стаць магутным каталізатарам для Белага дома. Рэгулятары і раней прыглядаліся да бяспекі нейрасетак, але цяпер распрацоўшчыкі ШІ самі даюць уладам жалезны аргумент для ўвядзення жорсткага дзяржкантролю над сабой жа.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.