Дапамажыце dev.by 🤍
Падтрымаць

Anthropic прадставіла Fable 5.1 і Mythos 5.1 — новыя мадэлі для кодынгу

Кампанія прадставіла Claude Fable 5.1 і Mythos 5.1 — новыя версіі мадэлі для праграмавання, агентных і навуковых задач. Fable даступная ўсім, а Mythos — толькі правераным партнёрам.

2 каментарыя
Anthropic прадставіла Fable 5.1 і Mythos 5.1 — новыя мадэлі для кодынгу

Кампанія прадставіла Claude Fable 5.1 і Mythos 5.1 — новыя версіі мадэлі для праграмавання, агентных і навуковых задач. Fable даступная ўсім, а Mythos — толькі правераным партнёрам.

Адна з галоўных змен датычыць кошту працы ШІ-агентаў з вялікім пастаянным кантэкстам. Цана чытання дадзеных з кэша для Fable знізілася з $1 да $0,25 за мільён токенаў — на 75%. Базавыя цэны пры гэтым не змяніліся: $10 за мільён уваходных і $50 за мільён выходных токенаў.

Гэта асабліва важна для агентаў, якія гадзінамі працуюць з адным рэпазіторыем, наборам дакументаў або гісторыяй дыялогу і пастаянна звяртаюцца да ўжо загружанай інфармацыі. Паводле ацэнкі Anthropic, новая цана кэша можа знізіць фактычны кошт Fable прыкладна на 25% пры тыповых сцэнарыях і да 45% пры асабліва інтэнсіўнай агентнай працы.

Кампанія таксама заяўляе, што ўдасканаліла абарончыя механізмы. У Claude Code яны цяпер умешваюцца прыкладна на 60% радзей, чым у Fable 5, пры гэтым Anthropic працягвае абмяжоўваць генерацыю эксплойтаў, некаторыя віды пентэсцінгу ды іншыя патэнцыйна небяспечныя дзеянні.

Паводле ўласных тэстаў Anthropic, Fable 5.1 прыкметна палепшылася ў працяглых задачах. У Terminal-Bench 4.0 мадэль атрымала 55,8% супраць 42% у Fable 5, а Mythos 5.1 з менш строгімі кіберабмежаваннямі — 60,9%. У навуковым Terminal-Bench-Science вынік Fable вырас з 24,7% да 52,6%. Гэтыя паказчыкі апублікаваны самой Anthropic і не з’яўляюцца незалежнай ацэнкай.

Кампанія прыводзіць і прыклады ад ранніх карыстальнікаў. У Ramp мадэль без умяшання чалавека выконвала адну ML-задачу 38 гадзін, самастойна перагледзела першапачатковы вынік і запусціла шэсць дадатковых эксперыментаў. Millennium сцвярджае, што Fable 5.1 змагла знайсці прычыну рэдкага праграмнага збою, якую не ўдавалася ўстанавіць чатыры–пяць гадоў.

Адначасова Anthropic прадставіла Enterprise Frontier Safeguards (EFS) — сістэму для кампаній, якім важна не перадаваць дадзеныя маніторынгу самой Anthropic. Логі ды іншая інфармацыя змогуць захоўвацца ў інфраструктуры кліента ў AWS, Azure або Google Cloud, а аўтаматычныя сістэмы Anthropic будуць шукаць у іх прыкметы небяспечнага выкарыстання. Разгортванне EFS пачнецца ўвосень.

Новая работа программиста — не писать код а задавать границы для ИИ-агентов — мнение
Новая праца праграміста — не пісаць код, а задаваць межы для ІІ-агентаў — меркаванне
Па тэме
Новая праца праграміста — не пісаць код, а задаваць межы для ІІ-агентаў — меркаванне
ІІ проник в 80% профессий но массового внедрения пока нет
ІІ пранік у 80% прафесій, але масавага ўкаранення пакуль няма
Па тэме
ІІ пранік у 80% прафесій, але масавага ўкаранення пакуль няма
Anthropic зменіць ліміты Claude Code: фармальна +25% фактычна -17%
Anthropic зменіць ліміты Claude Code: фармальна +25%, фактычна -17%
Па тэме
Anthropic зменіць ліміты Claude Code: фармальна +25%, фактычна -17%
Чытайце таксама
Anthropic выпусціла Claude Fable 5 — публічную версію нашумелай Mythos
Anthropic выпусціла Claude Fable 5 — публічную версію нашумелай Mythos
Anthropic выпусціла Claude Fable 5 — публічную версію нашумелай Mythos
Anthropic выбачылася за схаваныя абмежаванні Claude і змяніла палітыку пасля крытыкі
Anthropic выбачылася за схаваныя абмежаванні Claude і змяніла палітыку пасля крытыкі
Anthropic выбачылася за схаваныя абмежаванні Claude і змяніла палітыку пасля крытыкі
Anthropic выпусціла Claude Opus 5 — амаль як Fable 5, але ўдвая танней
Anthropic выпусціла Claude Opus 5 — амаль як Fable 5, але ўдвая танней
Anthropic выпусціла Claude Opus 5 — амаль як Fable 5, але ўдвая танней
Anthropic прадставіла Fable 5.1 і Mythos 5.1 — новыя мадэлі для кодынгу
Anthropic прадставіла Fable 5.1 і Mythos 5.1 — новыя мадэлі для кодынгу
Anthropic прадставіла Fable 5.1 і Mythos 5.1 — новыя мадэлі для кодынгу
2 каментарыя

Хочаце паведаміць важную навіну? Пішыце ў Telegram-бот

Галоўныя падзеі і карысныя спасылкі ў нашым Telegram-канале

Абмеркаванне
Каментуйце без абмежаванняў

Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.

0

Моё субьективное мнение после недолгой, но плотной работы с fable 5.1 - окно контекста стало несколько меньше, чем у fable 5. Остальное вроде норм, агентами хорошо управляет.

0

Рекомендую резюме в Anthropic закинуть - не сомневаюсь, что им пригодятся эксперты, способные за несоколько часов "плотной работы" с моделью вынести о ней вердикт.