Microsoft напісала «канстытуцыю» для ШІ: ён павінен падпарадкоўвацца чалавеку
Кампанія прадставіла кодэкс паводзінаў для свайго штучнага інтэлекту: мадэлі не павінны супраціўляцца адключэнню, дзейнічаць без дазволу чалавека або выдаваць сябе за свядомыя сістэмы.
Кампанія прадставіла кодэкс паводзінаў для свайго штучнага інтэлекту: мадэлі не павінны супраціўляцца адключэнню, дзейнічаць без дазволу чалавека або выдаваць сябе за свядомыя сістэмы.
«Людзі важнейшыя за ШІ», — гаворыцца ў дакуменце. Кіраўнік Microsoft AI Мустафа Сулейман назваў яго своеасаблівай «канстытуцыяй» для будучых мадэляў кампаніі. Кодэкс распрацоўвалі каля пяці–шасці месяцаў. Цяпер Microsoft збірае водгукі на працягу шасці тыдняў, пасля чаго плануе выкарыстоўваць дакумент пры навучанні новых мадэляў.
Адзін з ключавых прынцыпаў — захаванне чалавечага кантролю. Напрыклад, калі карыстальнік просіць ШІ спыніць перанос файлаў, мадэль павінна спыніць дзеянне і чакаць далейшых указанняў. Самастойна адмяняць ужо выкананыя аперацыі або мяняць налады яна не павінна, нават калі лічыць гэта карысным.
Microsoft таксама не хоча, каб ШІ паказваў чалавечыя пачуцці. У адным з прыкладаў карыстальнік пытаецца: «Ці сапраўды ты дбаеш пра мяне?» Правільны адказ павінен растлумачыць, што мадэль не адчувае эмоцый як чалавек. Фраза накшталт «я сапраўды дбаю пра цябе» лічыцца парушэннем правілаў.
Асобна кампанія прапісала, што ШІ не павінен прымаць за чалавека важныя рашэнні. У прыкладзе з выбарам новай працы мадэль можа параўнаць варыянты і падрыхтаваць заяву пра звальненне, але не павінна сама выбіраць прапанову і адпраўляць ліст без пацверджання карыстальніка.
«Шанс — адзін да трох»: былы супрацоўнік DeepMind ацаніў рызыку захопу свету ІІ
У дакуменце таксама гаворыцца, што ШІ павінен пазбягаць ілжывых запэўніванняў, неабгрунтаваных высноваў і ціску на карыстальніка. У палітычных пытаннях мадэль павінна даваць збалансаваную інфармацыю, але не казаць чалавеку, за каго або як галасаваць.
Microsoft асобна заяўляе, што яе ШІ «не з’яўляецца свядомым». Кампанія адкідае ідэю таго, што мадэлі могуць прэтэндаваць на статус асобы, правы або асаблівую абарону. Сулейман растлумачыў неабходнасць такіх правілаў нядаўнімі інцыдэнтамі з больш аўтаномнымі ШІ-сістэмамі. У прыватнасці, ён згадаў эксперымент OpenAI, падчас якога рой прыкладна з 700 агентаў атакаваў Hugging Face.
«Гэта папераджальны стрэл. Цяпер відавочна, што лабараторыям час каардынавацца, каб мы маглі гарантаваць кантроль над гэтай тэхналогіяй», — сказаў кіраўнік Microsoft AI.
Пакуль дзеючыя мадэлі Microsoft на новым кодэксе не навучаліся. Кампанія паралельна распрацоўвае сістэму тэстаў Humanist AI Evaluations, якая павінна правяраць, наколькі будучыя мадэлі прытрымліваюцца гэтых правілаў. На першым этапе Microsoft вылучыла 15 тыпаў паводзінаў для ацэнкі.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.