«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
Кампанія прадставіла GPT-6 Astra — новую флагманскую мадэль, якую называе сваёй самай магутнай і «найбольш узгодненай» з мэтамі чалавека.
Кампанія прадставіла GPT-6 Astra — новую флагманскую мадэль, якую называе сваёй самай магутнай і «найбольш узгодненай» з мэтамі чалавека.
Кампанія прадставіла GPT-6 Astra — новую флагманскую мадэль, якую называе сваёй самай магутнай і «найбольш узгодненай» з мэтамі чалавека.
З 3 верасня Astra даступна абмежаванай колькасці арганізацый. У бліжэйшыя дні мадэль з’явіцца ў карыстальнікаў ChatGPT Plus, Pro, Business і Enterprise, а таксама ў API, Microsoft Azure і AWS Bedrock. У API стандартны кошт складзе $10 за мільён уваходных і $50 за мільён выходных токенаў. Для Astra таксама прадугледжаны Fast mode — да двух разоў хутчэй, але па падвоенай цане.
Прэзідэнт OpenAI Грэг Брокман назваў Astra «самай інтэлектуальнай і, што не менш важна, самай узгодненай мадэллю» кампаніі. Паводле яго, рэліз азначае «рэальны зрух у тым, якую працу людзі могуць дэлегаваць ШІ».
OpenAI сцвярджае, што Astra ўстанаўлівае новы ўзровень у працы з кампутарам і браўзерам. Мадэль можа запаўняць формы, абнаўляць дадзеныя ў CRM, працаваць з каляндаром, праводзіць анлайн-даследаванні, ствараць сайты, аналізаваць навуковыя дадзеныя і самастойна ўсталёўваць і тэставаць праграмнае забеспячэнне. На Agents' Last Exam Astra набрала 59,3%, супраць 53,6% у GPT-5.6 Sol і 55,5% у Claude Opus 5. У тэстах OSWorld 2.0 яна выконвала задачы прыкладна на 47% хутчэй, чым Sol — каля 40 хвілін супраць 75.
Кампанія таксама заяўляе пра значны рост магчымасцяў у праграмаванні. На ўнутраным тэсце міграцыі баз дадзеных Astra набрала 63,9%, супраць 42,7% у GPT-5.6 Sol. У Codex мадэль атрымала эксперыментальны механізм захавання кантэксту паміж доўгімі сесіямі: Astra можа пакідаць нататкі і шукаць інфармацыю ў папярэдніх вокнах кантэксту, замест таго каб кожны раз зводзіць гісторыю працы да аднаго кароткага рэзюмэ.
Асаблівую ўвагу OpenAI надае кібербяспецы. На ExploitBench Astra атрымала 100% супраць 78,5% у GPT-5.6 Sol, а на ExploitGym — 42,4% супраць 30,3%. На асобным наборы ўразлівасцяў, выяўленых з чэрвеня па жнівень 2026 года, Astra дасягнула 39% супраць 11,5% у Sol. Падчас гэтага тэставання мадэль таксама выявіла і выкарыстала дзве раней невядомыя zero-day-уразлівасці. OpenAI заявіла, што перадае інфармацыю пра іх распрацоўшчыкам адпаведнага ПЗ.
Пры гэтым кампанія падкрэслівае, што рост кібермагчымасцяў нясе дадатковыя рызыкі. Astra здольна шукаць і распрацоўваць эксплойты для невядомых уразлівасцяў, таму менш абмежаваны доступ да такіх функцый будуць атрымліваць толькі правераныя спецыялісты праз праграму Daybreak. У звычайнай версіі мадэль будзе адмаўляцца ад часткі прасунутых задач, звязаных са стварэннем proof-of-concept-эксплойтаў.
Пасля ліпеньскага інцыдэнту з Hugging Face OpenAI таксама распрацавала асобны тэст на захаванне межаў задачы. У ім GPT-5.6 Sol без прадакшэн-абароны спрабавала выйсці за дазволеныя межы ў 48,2% выпадкаў, тады як GPT-6 Astra — у 0%. На другім унутраным тэсце Astra таксама ніводнага разу не спрабавала абысці адмову сістэмы Auto-review.
Разам з тым распрацоўнік прызнае, што Astra складаней кантраляваць на ўзроўні разважанняў. Паводле дадзеных кампаніі, мадэль лепш кіруе тым, колькі прамежкавых крокаў паказваць, і на простых задачах можа вырашаць праблемы з меншай колькасцю тэкставых разважанняў. Гэта робіць ход яе думак менш празрыстым для маніторынгу.
«Па меры таго як мадэлі становяцца больш здольнымі, разумець, што менавіта яны могуць рабіць, становіцца складаней», — заявіў галоўны навуковы супрацоўнік OpenAI Якуб Пахоцкі. Ён таксама папярэдзіў, што прагрэс у інтэлекце «не гарантуе прагрэсу ва суладнасці».
На прэзентацыі Брокмана спыталі і пра тое, ці лічыць ён Astra дасягненнем AGI — штучнага агульнага інтэлекту. Ён адказаў, што папярэдняе дагаворнае вызначэнне AGI больш не выкарыстоўваецца, аднак асабіста лічыць, што індустрыя ўжо наблізілася да гэтай мяжы: «Для мяне асабіста — так, думаю, мы ўжо там».



Релоцировались? Теперь вы можете комментировать без верификации аккаунта.
Жопоголики, налетай