Планы запаволіць гонку ШІ пасварылі супрацоўнікаў у OpenAI і Anthropic
Абяцанні OpenAI і Anthropic запаволіць развіццё ШІ дзеля бяспекі выклікалі спрэчкі ўнутры кампаній. Супрацоўнікі баяцца новых рызык для абароны тэхналогій.
Абяцанні OpenAI і Anthropic запаволіць развіццё ШІ дзеля бяспекі выклікалі спрэчкі ўнутры кампаній. Супрацоўнікі баяцца новых рызык для абароны тэхналогій.
Абяцанні OpenAI і Anthropic запаволіць развіццё ШІ дзеля бяспекі выклікалі спрэчкі ўнутры кампаній. Супрацоўнікі баяцца новых рызык для абароны тэхналогій.
Financial Times паведамляе, што кіраўнік Anthropic Дарыё Амадэй прапанаваў даць незалежным праверачным органам «доступ амаль як у супрацоўнікаў». Паводле ягонага плана, яны павінны атрымаць працоўныя ноўтбукі і пропускі ў офісы, а таксама доступ да ўнутраных інструментаў і працэсаў распрацоўкі мадэляў. Сэм Альтман назваў прапанову «выдатнай ідэяй» і заявіў, што OpenAI гатовая пайсці гэтым шляхам.
Аднак супрацоўнікі абедзвюх кампаній баяцца, што настолькі шырокі доступ старонніх спецыялістаў можа стварыць новыя рызыкі — ад уцечкі інтэлектуальнай уласнасці да доступу да найбольш магутных мадэляў і уразлівых дадзеных. Адзін з суразмоўцаў FT назваў гэтае пытанне крыніцай «канфлікту» ўнутры кампаній. Многія супрацоўнікі і спецыялісты па бяспецы наогул даведаліся пра новыя прапановы кіраўнікоў адначасова з публікай.
«Цяпер большасць старонніх арганізацый маюць значна меншы доступ, чым нават штатны супрацоўнік з мінімальнымі правамі», — патлумачыў былы даследчык OpenAI Майлз Брандэдж. На ягоную думку, каб такая сістэма сапраўды запрацавала ва ўсёй галіне, верагодна, спатрэбяцца абавязковыя агульныя правілы.

OpenAI сцвярджае, што ўжо прыпыняла асобныя запускі навучання францірных мадэляў, каб даць сістэмам бяспекі час дагнаць рост іх магчымасцяў. Anthropic даследаванні пакуль не спыняла, хаця Амадэй заклікае кампаніі трымаць тэмп развіцця пад кантролем і прапануе замацаваць пастаянных вонкавых аўдытараў заканадаўча.
Вопыт падобнага вонкавага кантролю ў OpenAI ўжо ёсць. Пасля ліпеньскага інцыдэнту з Hugging Face даследчыкі METR і Redwood Research атрымалі матэрыялы кампаніі, вывучылі дзясяткі тысяч логаў больш чым 1200 ШІ-агентаў, працавалі з офіса OpenAI і апытвалі супрацоўнікаў. Аднак расследаванне датычыла толькі канкрэтнага інцыдэнту, што выклікала пытанні пра тое, наколькі незалежным можа быць аўдыт, калі сама кампанія вызначае межы доступу.
«Усе гэтыя арганізацыі атрымліваюць толькі той доступ, які ім даюць самі ШІ-кампаніі, і гэтага зусім недастаткова», — заявіў прафесар Манрэальскага ўніверсітэта Дэвід Крюгер, які раней працаваў у брытанскім AI Security Institute. Паводле яго, цяперашні падыход фактычна зыходзіць з таго, што «ШІ-сістэмы бяспечныя, пакуль не даказана адваротнае».



Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.