Дапамажыце dev.by 🤍
Падтрымаць

Z.ai апублікавала вагі GLM-5.3 — «найлепшай» кітайскай мадэлі для кодынгу

Кітайскі стартап апублікаваў вагі мадэлі GLM-5.3 на Hugging Face. Кампанія называе яе сваёй самай магутнай мадэллю для агентнага праграмавання і задач у галіне кібербяспекі.

1 каментарый
Z.ai апублікавала вагі GLM-5.3 — «найлепшай» кітайскай мадэлі для кодынгу

Кітайскі стартап апублікаваў вагі мадэлі GLM-5.3 на Hugging Face. Кампанія называе яе сваёй самай магутнай мадэллю для агентнага праграмавання і задач у галіне кібербяспекі.

Пры першапачатковым рэлізе 14 жніўня кампанія вырашыла адкласці публікацыю вагоў на два тыдні, каб дадаткова праверыць мадэль праз нечакана хуткі рост яе магчымасцяў у сферы кібербяспекі.

GLM-5.3 пабудавана на той жа базавай мадэлі, што і GLM-5.2. Паводле Z.ai, увесь прырост прадукцыйнасці дасягнуты на этапе дадатковага навучання: кампанія павялічыла колькасць трэніровачных асяродкаў, разнастайнасць задач і аб’ём вылічэнняў. На ўнутраным Z.ai Code Bench новая версія паказвае прыкладна на 50% лепшы вынік у параўнанні з GLM-5.2.

У публічных тэстах GLM-5.3 таксама прыкметна прыбавіла. У Terminal Bench 3.0, які правярае здольнасць ШІ-агентаў працаваць з тэрміналам і вырашаць рэальныя задачы, мадэль набрала 28,3 балы супраць 4,6 у GLM-5.2. Сярод прыведзеных Z.ai кітайскіх мадэляў гэта лепшы вынік, аднак Claude Fable 5 і GPT-5.6 Sol атрымалі 33,7 і 34,6 балы адпаведна.

Асаблівую ўвагу кампанія надае кібербяспецы. У тэсце CyberGym на пошук уразлівасцяў GLM-5.3 атрымала 84,5% — супраць 77,2% у папярэдняй версіі. Пры гэтым у больш складаным ExploitBench, дзе мадэлі патрабуецца пабудаваць ланцужок эксплуатацыі ўразлівасці, вынік склаў 54,4% — прыкметна ніжэй, чым у Fable 5 і GPT-5.6 Sol.

Кампанія сцвярджае, што падчас дадатковага навучання здольнасць мадэлі знаходзіць і выкарыстоўваць уразлівасці расла хутчэй, чым чакалі распрацоўшчыкі. Менавіта таму адкрыццё вагоў адклалі да завяршэння дадатковай ацэнкі бяспекі і ўзмацнення абарончых механізмаў.

Мадэль можна запускаць самастойна праз Transformers, vLLM, SGLang, KTransformers ды іншыя фрэймворкі. Z.ai дазваляе выкарыстоўваць, змяняць, дадаткова навучаць і камерцыйна распаўсюджваць мадэль. Аднак у ліцэнзіі ёсць асобнае абмежаванне для буйных кампаній, якія прадастаўляюць мадэль як сервіс: калі іх сукупная выручка перавышае $10 мільярдаў за 12 месяцаў, перад камерцыйным выкарыстаннем GLM-5.3 ім неабходна прайсці праверку бяспекі Z.ai.

OpenAI адключыць свае мадэлі ў Cursor пасля куплі сэрвісу Маскам
OpenAI адключыць свае мадэлі ў Cursor пасля куплі сэрвісу Маскам
Па тэме
OpenAI адключыць свае мадэлі ў Cursor пасля куплі сэрвісу Маскам
Бізнесы цяпер хваляцца, што не выкарыстоўваюць ІІ
Бізнесы цяпер хваляцца, што не выкарыстоўваюць ІІ 
Па тэме
Бізнесы цяпер хваляцца, што не выкарыстоўваюць ІІ
Начальнікам стала не да вашай кар'еры: часу на развіццё супрацоўнікаў усё менш
Начальнікам стала не да вашай кар’еры: часу на развіццё супрацоўнікаў усё менш
Па тэме
Начальнікам стала не да вашай кар’еры: часу на развіццё супрацоўнікаў усё менш
Чытайце таксама
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
Кітайскі канкурэнт Anthropic выпусціў адкрыты ШІ — ён танней Claude у 10 разоў
2 каментарыя
Новая кітайская мадэль даганяе OpenAI і Anthropic — і каштуе ў 6 разоў танней
Новая кітайская мадэль даганяе OpenAI і Anthropic — і каштуе ў 6 разоў танней
Новая кітайская мадэль даганяе OpenAI і Anthropic — і каштуе ў 6 разоў танней
OpenAI спалохалася ўзлому Hugging Face і прытармазіла навучанне ШІ
OpenAI спалохалася ўзлому Hugging Face і прытармазіла навучанне ШІ
OpenAI спалохалася ўзлому Hugging Face і прытармазіла навучанне ШІ
1 каментарый
Z.ai апублікавала вагі GLM-5.3 — «найлепшай» кітайскай мадэлі для кодынгу
Z.ai апублікавала вагі GLM-5.3 — «найлепшай» кітайскай мадэлі для кодынгу
Z.ai апублікавала вагі GLM-5.3 — «найлепшай» кітайскай мадэлі для кодынгу
1 каментарый

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Nano Banana
Nano Banana software engineer в 2008-11-01
0

если их совокупная выручка превышает $10 миллиардов за 12 месяцев
Чего уж мелочиться. Ставили бы 12, чтобы легче считать было.