Support us

Anthropic создала модель мощнее Mythos, но боится её выпускать

Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.

5 комментариев
Anthropic создала модель мощнее Mythos, но боится её выпускать

Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.

Anthropic разработала новую ИИ-модель под внутренним названием Model 2, которая в целом превосходит флагманскую Mythos 5. Выпускать ее для внешних пользователей компания пока не планирует, следует из нового отчета компании о рисках, как сообщает Axios.

В отчете Model 2 называют «заметным улучшением» по сравнению с Mythos 5 для многих задач, с которыми сотрудники работают внутри компании. При этом скачок возможностей оказался меньше, чем при переходе от Claude Opus 4.6 к Mythos Preview.

Model 2 уже активно используют внутри компании вместе с Mythos 5 — в том числе для программирования, генерации данных и агентных задач. Обе модели также применяют в исследованиях и инженерной работе. В отдельных областях Model 2 превосходит Mythos 5, в других уступает ей, но в целом компания оценивает ее как немного более мощную.

При этом Anthropic не провела для Model 2 полный набор стандартных тестов, которые обычно выполняет перед публичным запуском. Поэтому компания отмечает, что ее уверенность в оценке возможностей новой модели ниже обычного. Планов выпускать новую модель для внешних пользователей сейчас нет.

Одновременно Anthropic повысила общую оценку риска рассогласования моделей в ситуациях с высокими ставками с «очень низкой» до «низкой». Компания объясняет изменение возросшей неопределенностью после недавних инцидентов, выявленных во время тестирования моделей в области кибербезопасности. При этом вероятность катастрофического вреда от известных форм проблемного поведения моделей Anthropic по-прежнему оценивает как низкую.

Еще одна причина для осторожности — ускорение возможностей ИИ в автоматизированных исследованиях и разработке. Anthropic видит первые признаки того, что модели начинают заметнее ускорять такую работу. Одновременно некоторые привычные тесты достигли своего предела и уже плохо фиксируют дальнейший рост возможностей новых систем. Из-за этого разработчик признает, что оценивать риски наиболее мощных моделей становится сложнее.

SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
По теме
SpaceX купила Cursor за $60 млрд — стартап уже помогает обучать Grok
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
По теме
3 млрд загрузок за полгода: самые скачиваемые ИИ-модели в мире — не от OpenAI и Anthropic
Anthropic объяснила как будет прятать «водяной знак» в текстах Claude
Anthropic объяснила, как будет прятать «водяной знак» в текстах Claude
По теме
Anthropic объяснила, как будет прятать «водяной знак» в текстах Claude
Читайте также
Anthropic показала мощный ИИ для поиска уязвимостей, но держит его закрытым
Anthropic показала мощный ИИ для поиска уязвимостей, но держит его закрытым
Anthropic показала мощный ИИ для поиска уязвимостей, но держит его закрытым
Anthropic выпустила кодинг-модель, но специально урезала её возможности
Anthropic выпустила кодинг-модель, но специально урезала её возможности
Anthropic выпустила кодинг-модель, но специально урезала её возможности
Все испугались модели Mythos от Anthropic, больше всего — банкиры
Все испугались модели Mythos от Anthropic, больше всего — банкиры
Все испугались модели Mythos от Anthropic, больше всего — банкиры
2 комментария
Саботаж от Anthropic: новые модели Mythos ухудшают ответы, если распознают ИИ-исследования, разрабы в ярости
Саботаж от Anthropic: новые модели Mythos ухудшают ответы, если распознают ИИ-исследования, разрабы в ярости
Саботаж от Anthropic: новые модели Mythos ухудшают ответы, если распознают ИИ-исследования, разрабы в ярости

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

krwa
krwa VP of Engineering в Super Duper Development
0

Обычное поддержание инфоповодов о компании.
Просто помните, что лет 5 назад до чёртиков боялись выпускать gpt-2. И ничего, мир не рухнул. Не рухнет и тут.
Точнее рухнет антропик, когда ии-хайп сойдёт на нет и появятся более дешёвые модели.

0

Вась, клод уже полгода пилит claude code и прочие антропик сервисы. ИИ хайп сойдет на нет? Ничего что это новая технология как мобильные телефоны которые актуальы до сих пор с гиганскими внутренними рынками приложений? Смешно с таких людей)

krwa
krwa VP of Engineering в Super Duper Development
0

Клоду больше года и в моей (именно с формы собственности) компании пишут почти весь код с ним.
Фраза выше была не про "используется" или нет, а про экономическую эффективность этих компаний.
Они в глубоком минусе и с текущей моделью они не выплывут никогда. А ещё проблема в их пути - "добавить больше железа, добавить больше параметров - глядишь и поумнеют мождели" не работает в долгосроке. Закон убывающей полезности. Да, они немного поумнеют, если вложить ещё 20 лярдов, но скаждым вложенным долларом выхлоп всё меньше и меньше. Тут надо в другую сторону копать, а не на fomo бежать и втупую решать проблему. Хассабис этим занимался, но гугл из-за fomo снял его, чтобы дальше учить llm-ки на несуществующих текстах.

2

Да я ещё в 2024 создал модель, которая мощнее чем mythos, да так с тех пор и боюсь выпустить!

krwa
krwa VP of Engineering в Super Duper Development
1

а я в 2004! Так и пылится на древнем HDD. Для запуска требуется Athlon 3000+ и 256 мб DDR