Дапамажыце dev.by 🤍
Падтрымаць

ШІ без цэнзуры цяпер прадаюць па падпісцы — стартап запусціў сервіс для распрацоўшчыкаў

Амерыканскі стартап Abliteration.ai пачаў прадаваць праз API доступ да GLM-5.3 з аслабленымі механізмамі адмовы. Мадыфікаваная мадэль радзей адхіляе адчувальныя запыты, у тым ліку звязаныя з кібербяспекай.

Пакінуць каментарый
ШІ без цэнзуры цяпер прадаюць па падпісцы — стартап запусціў сервіс для распрацоўшчыкаў

Амерыканскі стартап Abliteration.ai пачаў прадаваць праз API доступ да GLM-5.3 з аслабленымі механізмамі адмовы. Мадыфікаваная мадэль радзей адхіляе адчувальныя запыты, у тым ліку звязаныя з кібербяспекай.

Кампанія выкарыстоўвае тэхніку abliteration: знаходзіць унутраныя патэрны, якія выклікаюць адмовы, і змяняе вагі мадэлі, каб падавіць іх. Як адзначаюць распрацоўшчыкі, гэта не джэйлбрэйк праз промпт, а змяненне самой нейрасеткі. Стартап сцвярджае, што асноўныя магчымасці ў кодынгу і працы ШІ-агентаў пры гэтым захоўваюцца.

Сервіс разлічаны на спецыялістаў па кібербяспецы, якія тэстуюць абароненасць сістэм, аналізуюць шкоднаснае ПЗ і правяраюць ШІ-агентаў на ўразлівасць да промпт-ін’екцый. Паводле ананімнага заснавальніка, сярод першых кліентаў — кампаніі, якія правяраюць агентаў буйных арганізацый і банкаў. Доступ каштуе $5 за мільён уваходных або выходных токенаў, а ўласныя GPU кліентам не патрэбны.

Аднак даступнасць мадэлі зніжае і бар’ер для злоўжыванняў. Выданне TechCrunch паведаміла, што змагло атрымаць ад яе код для здабывання захаваных пароляў Chrome і падрабязныя інструкцыі па стварэнні небяспечнага біяпатагена. Пры гэтым абмежаванні на запыты пра самапашкоджанні працягвалі дзейнічаць.

Abliteration.ai сцвярджае, што не захоўвае промпты і адказы карыстальнікаў і не патрабуе звычайнай праверкі асобы. Кампанія захоўвае платежныя і тэхнічныя метададзеныя. Карпаратыўныя кліенты могуць асобна ўключыць шлюз палітык, каб блакаваць, змяняць або запісваць пэўныя запыты, але стандартны доступ застаецца ў значнай ступені неабмежаваным.

Неабходнасць такога падыходу выклікае спрэчкі. Паводле дадзеных SaferAI, зыходная GLM-5.2 і без мадыфікацыі не адмаўлялася выконваць задачы ў іх тэстах наступальнай кібербяспекі. Іншыя даследаванні паказваюць, што abliteration можа змяняць паводзіны мадэлі нават на запытах, якія яна першапачаткова не адхіляла.

OpenAI выпусціла падрабязны гайд для промптынгу GPT-6 Astra
OpenAI выпусціла падрабязны гайд для промптынгу GPT-6 Astra
Па тэме
OpenAI выпусціла падрабязны гайд для промптынгу GPT-6 Astra
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
Па тэме
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
«Ніхто не гатовы да наступстваў»: галоўны вучоны OpenAI заклікаў запаволіць развіццё ШІ
«Ніхто не гатовы да наступстваў»: галоўны вучоны OpenAI заклікаў запаволіць развіццё ШІ 
Па тэме
«Ніхто не гатовы да наступстваў»: галоўны вучоны OpenAI заклікаў запаволіць развіццё ШІ
Чытайце таксама
ByteDance запусціла самы танны ШІ для кадавання — усяго за $1,30 у месяц
ByteDance запусціла самы танны ШІ для кадавання — усяго за $1,30 у месяц
ByteDance запусціла самы танны ШІ для кадавання — усяго за $1,30 у месяц
«Джын ужо выпушчаны»: з адкрытых ШІ-мадэляў можна зняць абарону за некалькі хвілінаў
«Джын ужо выпушчаны»: з адкрытых ШІ-мадэляў можна зняць абарону за некалькі хвілінаў
«Джын ужо выпушчаны»: з адкрытых ШІ-мадэляў можна зняць абарону за некалькі хвілінаў
2 каментарыя
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
2 каментарыя
Дыстыляцыя ШІ-мадэляў можа стаць кашмарам для OpenAI, Anthropic і Google
Дыстыляцыя ШІ-мадэляў можа стаць кашмарам для OpenAI, Anthropic і Google
Дыстыляцыя ШІ-мадэляў можа стаць кашмарам для OpenAI, Anthropic і Google
2 каментарыя

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Абмеркаванне
Каментуйце без абмежаванняў

Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.

Каментарыяў пакуль няма.