Anthropic создала модель мощнее Mythos, но боится её выпускать
Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.
Компания уже использует более мощную Model 2 внутри компании, но не готова выпускать ее публично: разработчик повысил оценку рисков своих ИИ-моделей и признал, что прежние тесты все хуже отражают рост их возможностей.
Anthropic разработала новую ИИ-модель под внутренним названием Model 2, которая в целом превосходит флагманскую Mythos 5. Выпускать ее для внешних пользователей компания пока не планирует, следует из нового отчета компании о рисках, как сообщает Axios.
В отчете Model 2 называют «заметным улучшением» по сравнению с Mythos 5 для многих задач, с которыми сотрудники работают внутри компании. При этом скачок возможностей оказался меньше, чем при переходе от Claude Opus 4.6 к Mythos Preview.
Model 2 уже активно используют внутри компании вместе с Mythos 5 — в том числе для программирования, генерации данных и агентных задач. Обе модели также применяют в исследованиях и инженерной работе. В отдельных областях Model 2 превосходит Mythos 5, в других уступает ей, но в целом компания оценивает ее как немного более мощную.
При этом Anthropic не провела для Model 2 полный набор стандартных тестов, которые обычно выполняет перед публичным запуском. Поэтому компания отмечает, что ее уверенность в оценке возможностей новой модели ниже обычного. Планов выпускать новую модель для внешних пользователей сейчас нет.
Одновременно Anthropic повысила общую оценку риска рассогласования моделей в ситуациях с высокими ставками с «очень низкой» до «низкой». Компания объясняет изменение возросшей неопределенностью после недавних инцидентов, выявленных во время тестирования моделей в области кибербезопасности. При этом вероятность катастрофического вреда от известных форм проблемного поведения моделей Anthropic по-прежнему оценивает как низкую.
Еще одна причина для осторожности — ускорение возможностей ИИ в автоматизированных исследованиях и разработке. Anthropic видит первые признаки того, что модели начинают заметнее ускорять такую работу. Одновременно некоторые привычные тесты достигли своего предела и уже плохо фиксируют дальнейший рост возможностей новых систем. Из-за этого разработчик признает, что оценивать риски наиболее мощных моделей становится сложнее.
Обычное поддержание инфоповодов о компании.
Просто помните, что лет 5 назад до чёртиков боялись выпускать gpt-2. И ничего, мир не рухнул. Не рухнет и тут.
Точнее рухнет антропик, когда ии-хайп сойдёт на нет и появятся более дешёвые модели.
Вась, клод уже полгода пилит claude code и прочие антропик сервисы. ИИ хайп сойдет на нет? Ничего что это новая технология как мобильные телефоны которые актуальы до сих пор с гиганскими внутренними рынками приложений? Смешно с таких людей)
Клоду больше года и в моей (именно с формы собственности) компании пишут почти весь код с ним.
Фраза выше была не про "используется" или нет, а про экономическую эффективность этих компаний.
Они в глубоком минусе и с текущей моделью они не выплывут никогда. А ещё проблема в их пути - "добавить больше железа, добавить больше параметров - глядишь и поумнеют мождели" не работает в долгосроке. Закон убывающей полезности. Да, они немного поумнеют, если вложить ещё 20 лярдов, но скаждым вложенным долларом выхлоп всё меньше и меньше. Тут надо в другую сторону копать, а не на fomo бежать и втупую решать проблему. Хассабис этим занимался, но гугл из-за fomo снял его, чтобы дальше учить llm-ки на несуществующих текстах.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.
Обычное поддержание инфоповодов о компании.
Просто помните, что лет 5 назад до чёртиков боялись выпускать gpt-2. И ничего, мир не рухнул. Не рухнет и тут.
Точнее рухнет антропик, когда ии-хайп сойдёт на нет и появятся более дешёвые модели.
Вась, клод уже полгода пилит claude code и прочие антропик сервисы. ИИ хайп сойдет на нет? Ничего что это новая технология как мобильные телефоны которые актуальы до сих пор с гиганскими внутренними рынками приложений? Смешно с таких людей)
Клоду больше года и в моей (именно с формы собственности) компании пишут почти весь код с ним.
Фраза выше была не про "используется" или нет, а про экономическую эффективность этих компаний.
Они в глубоком минусе и с текущей моделью они не выплывут никогда. А ещё проблема в их пути - "добавить больше железа, добавить больше параметров - глядишь и поумнеют мождели" не работает в долгосроке. Закон убывающей полезности. Да, они немного поумнеют, если вложить ещё 20 лярдов, но скаждым вложенным долларом выхлоп всё меньше и меньше. Тут надо в другую сторону копать, а не на fomo бежать и втупую решать проблему. Хассабис этим занимался, но гугл из-за fomo снял его, чтобы дальше учить llm-ки на несуществующих текстах.
Да я ещё в 2024 создал модель, которая мощнее чем mythos, да так с тех пор и боюсь выпустить!
а я в 2004! Так и пылится на древнем HDD. Для запуска требуется Athlon 3000+ и 256 мб DDR