Meta выпусціла Muse Spark 1.3 — адну з самых танных мадэляў свайго класа
Кампанія прадставіла Muse Spark 1.3 — чацвёртую мадэль лінейкі за пяць месяцаў. Новая версія істотна прасунулася ў агентных і праграмных задачах і наблізілася да лідараў незалежных рэйтынгаў, пры гэтым застаецца адной з самых танных мадэляў у сваім класе.
Кампанія прадставіла Muse Spark 1.3 — чацвёртую мадэль лінейкі за пяць месяцаў. Новая версія істотна прасунулася ў агентных і праграмных задачах і наблізілася да лідараў незалежных рэйтынгаў, пры гэтым застаецца адной з самых танных мадэляў у сваім класе.
Muse Spark 1.3 даступная праз Muse Code і Meta Model API. Цяпер распрацоўшчыкі могуць выкарыстоўваць канфігурацыю xhigh, а больш магутная max пакуль праходзіць дадатковае тэставанне бяспекі і даступная толькі абмежаванаму колу партнёраў. Менавіта max паказвае найлепшыя вынікі Meta ў частцы бенчмаркаў, таму параўноўваць яе напрамую з шырокадаступнымі канкурэнтамі пакуль некарэктна.
Паводле дадзеных Artificial Analysis, версія max набрала 62 балы ў Intelligence Index, а даступная xhigh — 61. Для параўнання, Claude Fable 5.1 дасягае 66 балаў у рэжыме max і 65 у xhigh. Muse Spark 1.3 пры гэтым дзеліць пазіцыі з GPT-5.6 Sol max, Grok 4.6 high і Claude Opus 5 high.
Найбольш прыкметны рост прыйшоўся на агентныя задачы. На тэсце τ³-Bench Banking, дзе ШІ павінен працаваць з інструментамі ў сімуляваным банкаўскім асяроддзі, Muse Spark 1.3 max набрала 52%, а xhigh — 47%. У Terminal-Bench 2.1 вынік вырас прыкладна да 85–86%, хаця Claude Fable 5.1 па-ранейшаму застаецца вышэй — больш за 91% на максімальных наладах.
Meta таксама паведамляе, што новая версія стала больш эканомнай у рэальнай працы: ва ўнутраных тэстах па праграмаванні яна выкарыстоўвала прыкладна на 20% менш выклікаў інструментаў і на 25% менш токенаў, чым Muse Spark 1.2. Мадэль лепш утрымлівае некалькі паралельных задач у доўгім дыялогу, сама заўважае прабелы ў плане і запытвае ўдакладненні перад важнымі дзеяннямі.
Цана API пры гэтым не змянілася: $1,25 за мільён уваходных і $4,25 за мільён выходных токенаў. Паводле ацэнкі Artificial Analysis, выкананне адной задачы з іх індэкса каштуе каля $0,55 — гэта самы нізкі паказчык сярод мадэляў з вынікам 59 балаў і вышэй. Для параўнання, іншыя мадэлі на падобным узроўні абыходзяцца прыкладна ў $0,94–1,23 за задачу.
У параўнанні з Muse Spark 1.2 фактычны кошт адной задачы вырас з $0,40 да $0,55, нягледзячы на нязменны прайс за токены. Artificial Analysis звязвае гэта з большым расходам уваходных токенаў у агентных тэстах. Meta таксама абяцае выпусціць open-weight-версію Muse Spark, аднак пакуль не ўдакладняе, якая менавіта версія мадэлі атрымае адкрытыя вагі, калі адбудзецца рэліз і пад якой ліцэнзіяй.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.