Дапамажыце dev.by 🤍
Падтрымаць

Meta выпусціла Muse Spark 1.3 — адну з самых танных мадэляў свайго класа

Кампанія прадставіла Muse Spark 1.3 — чацвёртую мадэль лінейкі за пяць месяцаў. Новая версія істотна прасунулася ў агентных і праграмных задачах і наблізілася да лідараў незалежных рэйтынгаў, пры гэтым застаецца адной з самых танных мадэляў у сваім класе.

Пакінуць каментарый
Meta выпусціла Muse Spark 1.3 — адну з самых танных мадэляў свайго класа

Кампанія прадставіла Muse Spark 1.3 — чацвёртую мадэль лінейкі за пяць месяцаў. Новая версія істотна прасунулася ў агентных і праграмных задачах і наблізілася да лідараў незалежных рэйтынгаў, пры гэтым застаецца адной з самых танных мадэляў у сваім класе.

Muse Spark 1.3 даступная праз Muse Code і Meta Model API. Цяпер распрацоўшчыкі могуць выкарыстоўваць канфігурацыю xhigh, а больш магутная max пакуль праходзіць дадатковае тэставанне бяспекі і даступная толькі абмежаванаму колу партнёраў. Менавіта max паказвае найлепшыя вынікі Meta ў частцы бенчмаркаў, таму параўноўваць яе напрамую з шырокадаступнымі канкурэнтамі пакуль некарэктна.

Паводле дадзеных Artificial Analysis, версія max набрала 62 балы ў Intelligence Index, а даступная xhigh — 61. Для параўнання, Claude Fable 5.1 дасягае 66 балаў у рэжыме max і 65 у xhigh. Muse Spark 1.3 пры гэтым дзеліць пазіцыі з GPT-5.6 Sol max, Grok 4.6 high і Claude Opus 5 high.

Найбольш прыкметны рост прыйшоўся на агентныя задачы. На тэсце τ³-Bench Banking, дзе ШІ павінен працаваць з інструментамі ў сімуляваным банкаўскім асяроддзі, Muse Spark 1.3 max набрала 52%, а xhigh — 47%. У Terminal-Bench 2.1 вынік вырас прыкладна да 85–86%, хаця Claude Fable 5.1 па-ранейшаму застаецца вышэй — больш за 91% на максімальных наладах.

«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra
Па тэме
«Эпоха AGI пачалася»: OpenAI прадставіла звышмагутную GPT-6 Astra

Meta таксама паведамляе, што новая версія стала больш эканомнай у рэальнай працы: ва ўнутраных тэстах па праграмаванні яна выкарыстоўвала прыкладна на 20% менш выклікаў інструментаў і на 25% менш токенаў, чым Muse Spark 1.2. Мадэль лепш утрымлівае некалькі паралельных задач у доўгім дыялогу, сама заўважае прабелы ў плане і запытвае ўдакладненні перад важнымі дзеяннямі.

Цана API пры гэтым не змянілася: $1,25 за мільён уваходных і $4,25 за мільён выходных токенаў. Паводле ацэнкі Artificial Analysis, выкананне адной задачы з іх індэкса каштуе каля $0,55 — гэта самы нізкі паказчык сярод мадэляў з вынікам 59 балаў і вышэй. Для параўнання, іншыя мадэлі на падобным узроўні абыходзяцца прыкладна ў $0,94–1,23 за задачу.

У параўнанні з Muse Spark 1.2 фактычны кошт адной задачы вырас з $0,40 да $0,55, нягледзячы на нязменны прайс за токены. Artificial Analysis звязвае гэта з большым расходам уваходных токенаў у агентных тэстах. Meta таксама абяцае выпусціць open-weight-версію Muse Spark, аднак пакуль не ўдакладняе, якая менавіта версія мадэлі атрымае адкрытыя вагі, калі адбудзецца рэліз і пад якой ліцэнзіяй.

Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Па тэме
Anthropic выпусціла падрабязны гайд для промптынгу Claude Fable 5.1
Anthropic выпусціла шаблоны гандлёвых ІІ-агентаў. Кажа, яны павышаюць канверсію на 60%
Anthropic выпусціла шаблоны гандлёвых ІІ-агентаў. Кажа, яны павышаюць канверсію на 60%
Па тэме
Anthropic выпусціла шаблоны гандлёвых ІІ-агентаў. Кажа, яны павышаюць канверсію на 60%
Навукоўцы прыдумалі, як скараціць расход токенаў у 50 разоў
Навукоўцы прыдумалі, як скараціць расход токенаў у 50 разоў
Па тэме
Навукоўцы прыдумалі, як скараціць расход токенаў у 50 разоў

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.