Дапамажыце dev.by 🤍
Падтрымаць

«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra

Кампанія прадставіла GPT-6 Astra — новую флагманскую мадэль, якую называе сваёй самай магутнай і «найбольш узгодненай» з мэтамі чалавека.

1 каментарый
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra

Кампанія прадставіла GPT-6 Astra — новую флагманскую мадэль, якую называе сваёй самай магутнай і «найбольш узгодненай» з мэтамі чалавека.

З 3 верасня Astra даступна абмежаванай колькасці арганізацый. У бліжэйшыя дні мадэль з’явіцца ў карыстальнікаў ChatGPT Plus, Pro, Business і Enterprise, а таксама ў API, Microsoft Azure і AWS Bedrock. У API стандартны кошт складзе $10 за мільён уваходных і $50 за мільён выходных токенаў. Для Astra таксама прадугледжаны Fast mode — да двух разоў хутчэй, але па падвоенай цане.

Прэзідэнт OpenAI Грэг Брокман назваў Astra «самай інтэлектуальнай і, што не менш важна, самай узгодненай мадэллю» кампаніі. Паводле яго, рэліз азначае «рэальны зрух у тым, якую працу людзі могуць дэлегаваць ШІ».

OpenAI сцвярджае, што Astra ўстанаўлівае новы ўзровень у працы з кампутарам і браўзерам. Мадэль можа запаўняць формы, абнаўляць дадзеныя ў CRM, працаваць з каляндаром, праводзіць анлайн-даследаванні, ствараць сайты, аналізаваць навуковыя дадзеныя і самастойна ўсталёўваць і тэставаць праграмнае забеспячэнне. На Agents' Last Exam Astra набрала 59,3%, супраць 53,6% у GPT-5.6 Sol і 55,5% у Claude Opus 5. У тэстах OSWorld 2.0 яна выконвала задачы прыкладна на 47% хутчэй, чым Sol — каля 40 хвілін супраць 75.

Кампанія таксама заяўляе пра значны рост магчымасцяў у праграмаванні. На ўнутраным тэсце міграцыі баз дадзеных Astra набрала 63,9%, супраць 42,7% у GPT-5.6 Sol. У Codex мадэль атрымала эксперыментальны механізм захавання кантэксту паміж доўгімі сесіямі: Astra можа пакідаць нататкі і шукаць інфармацыю ў папярэдніх вокнах кантэксту, замест таго каб кожны раз зводзіць гісторыю працы да аднаго кароткага рэзюмэ.

Асаблівую ўвагу OpenAI надае кібербяспецы. На ExploitBench Astra атрымала 100% супраць 78,5% у GPT-5.6 Sol, а на ExploitGym — 42,4% супраць 30,3%. На асобным наборы ўразлівасцяў, выяўленых з чэрвеня па жнівень 2026 года, Astra дасягнула 39% супраць 11,5% у Sol. Падчас гэтага тэставання мадэль таксама выявіла і выкарыстала дзве раней невядомыя zero-day-уразлівасці. OpenAI заявіла, што перадае інфармацыю пра іх распрацоўшчыкам адпаведнага ПЗ.

Пры гэтым кампанія падкрэслівае, што рост кібермагчымасцяў нясе дадатковыя рызыкі. Astra здольна шукаць і распрацоўваць эксплойты для невядомых уразлівасцяў, таму менш абмежаваны доступ да такіх функцый будуць атрымліваць толькі правераныя спецыялісты праз праграму Daybreak. У звычайнай версіі мадэль будзе адмаўляцца ад часткі прасунутых задач, звязаных са стварэннем proof-of-concept-эксплойтаў.

Пасля ліпеньскага інцыдэнту з Hugging Face OpenAI таксама распрацавала асобны тэст на захаванне межаў задачы. У ім GPT-5.6 Sol без прадакшэн-абароны спрабавала выйсці за дазволеныя межы ў 48,2% выпадкаў, тады як GPT-6 Astra — у 0%. На другім унутраным тэсце Astra таксама ніводнага разу не спрабавала абысці адмову сістэмы Auto-review.

Разам з тым распрацоўнік прызнае, што Astra складаней кантраляваць на ўзроўні разважанняў. Паводле дадзеных кампаніі, мадэль лепш кіруе тым, колькі прамежкавых крокаў паказваць, і на простых задачах можа вырашаць праблемы з меншай колькасцю тэкставых разважанняў. Гэта робіць ход яе думак менш празрыстым для маніторынгу.

«Па меры таго як мадэлі становяцца больш здольнымі, разумець, што менавіта яны могуць рабіць, становіцца складаней», — заявіў галоўны навуковы супрацоўнік OpenAI Якуб Пахоцкі. Ён таксама папярэдзіў, што прагрэс у інтэлекце «не гарантуе прагрэсу ва суладнасці».

На прэзентацыі Брокмана спыталі і пра тое, ці лічыць ён Astra дасягненнем AGI — штучнага агульнага інтэлекту. Ён адказаў, што папярэдняе дагаворнае вызначэнне AGI больш не выкарыстоўваецца, аднак асабіста лічыць, што індустрыя ўжо наблізілася да гэтай мяжы: «Для мяне асабіста — так, думаю, мы ўжо там».

Чаму ІІ OpenAI і Anthropic могуць быць небяспечнейшыя за кітайскія мадэлі
Чаму ІІ OpenAI і Anthropic могуць быць небяспечнейшыя за кітайскія мадэлі
Па тэме
Чаму ІІ OpenAI і Anthropic могуць быць небяспечнейшыя за кітайскія мадэлі
Навучанне ІІ выходзіць з-пад кантролю? Кіраўнік OpenAI папярэдзіў пра рызыкі самонавучальнага ІІ
Навучанне ІІ выходзіць з-пад кантролю? Кіраўнік OpenAI папярэдзіў пра рызыкі самонавучальнага ІІ 
Па тэме
Навучанне ІІ выходзіць з-пад кантролю? Кіраўнік OpenAI папярэдзіў пра рызыкі самонавучальнага ІІ
Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Па тэме
Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Чытайце таксама
OpenAI тэрмінова абнавіла ChatGPT пасля абвяшчэння «чырвонага кода»
OpenAI тэрмінова абнавіла ChatGPT пасля абвяшчэння «чырвонага кода»
OpenAI тэрмінова абнавіла ChatGPT пасля абвяшчэння «чырвонага кода»
OpenAI выпусціла GPT-5.6: лепш за Claude Fable ў кодынгу і на трэць танней
OpenAI выпусціла GPT-5.6: лепш за Claude Fable ў кодынгу і на трэць танней
OpenAI выпусціла GPT-5.6: лепш за Claude Fable ў кодынгу і на трэць танней
OpenAI знізіла цэны на дзве мадэлі GPT-4.5
OpenAI знізіла цэны на дзве мадэлі GPT-4.5
OpenAI знізіла цэны на дзве мадэлі GPT-4.5
Новая мадэль OpenAI Astra вырашыла 10 матэматычных задач, над якімі навукоўцы білі галаву больш за дзесяць гадоў
Новая мадэль OpenAI Astra вырашыла 10 матэматычных задач, над якімі навукоўцы білі галаву больш за дзесяць гадоў
Новая мадэль OpenAI Astra вырашыла 10 матэматычных задач, над якімі навукоўцы білі галаву больш за дзесяць гадоў

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

0

Жопоголики, налетай