Anthropic выпустила Claude Opus 5.5 — дешевле на 40% и мощнее Fable 5.1
Компания представила Claude Opus 5.5 — новую модель для программирования, исследований и профессиональных задач. По оценке компании, она сопоставима с более дорогой Fable 5.1, а выполнение типичных задач обходится на 40% дешевле, чем с Opus 5.
Компания представила Claude Opus 5.5 — новую модель для программирования, исследований и профессиональных задач. По оценке компании, она сопоставима с более дорогой Fable 5.1, а выполнение типичных задач обходится на 40% дешевле, чем с Opus 5.
Основные улучшения связаны с агентным программированием. В тесте Terminal-Bench 4.0 новая модель справилась с 66,4% задач против 55,8% у Fable 5.1 и 52,3% у Opus 5. В FrontierCode v1.1 результат составил 54,4%, а в CursorBench 4.0 — 57,8%. Anthropic также сообщает об улучшениях в финансовом анализе, подготовке документов и научных задачах.
Результаты Claude Opus 5.5 в сравнении с другими моделями. Источник: Anthropic.
В реальных задачах ранние пользователи тоже зафиксировали прирост производительности. Один из тестировщиков перенес кодовую базу объемом 680 тысяч строк менее чем за сутки. Другой проверил и исправил 200 тысяч строк кода менее чем за три часа — предыдущей Opus 5 на аналогичную работу потребовалось более 20 часов.
Стоимость Opus 5.5 составляет $4 за миллион входных токенов и $20 за миллион выходных — на 20% ниже, чем у Opus 5. Чтение ранее сохраненного контекста подешевело на 60%, до $0,20 за миллион токенов.
Кроме того, модель генерирует ответы более чем на 30% быстрее предшественника и использует меньше токенов для решения задач. Для сравнения, Fable 5.1 стоит $10 и $50 за миллион входных и выходных токенов соответственно.
Для нашумевшей модели Jev вышел каталог инструментов на GitHub
Anthropic также переработала стиль ответов: модель реже использует профессиональный жаргон, выносит главное в начало сообщения и лучше следует требованиям пользователя к тексту. По словам одного из ранних тестировщиков, новая Opus «пишет так же, как я».
Отдельное внимание компания уделила безопасности. Opus 5.5 проверяли внешние исследователи из METR и Frontier Design. По данным Anthropic, в специальном тесте модель примерно на 85% реже пыталась обойти установленные ограничения, чем Opus 5 и Mythos 5.1.
Для задач в области кибербезопасности и биологии предусмотрены дополнительные защитные механизмы: часть запросов может автоматически перенаправляться другим моделям.
Claude Opus 5.5 уже доступна через API Anthropic, AWS, Google Cloud и Microsoft Azure. В ближайшие недели компания планирует выпустить Sonnet 5.5 и Haiku 5.5 с аналогичными улучшениями производительности и эффективности.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.