Claude стал умнее, но начал писать хуже — инженер Anthropic объяснил почему
Новые версии Claude лучше справляются с кодом, математикой и сложными рассуждениями, но из-за этого их тексты стали менее естественными и понятными для людей. Причину объяснил сотрудник Anthropic Джексон Кернион, который занимается дообучением Claude.
Новые версии Claude лучше справляются с кодом, математикой и сложными рассуждениями, но из-за этого их тексты стали менее естественными и понятными для людей. Причину объяснил сотрудник Anthropic Джексон Кернион, который занимается дообучением Claude.
По его словам, одна из причин — смещение обучения в сторону программирования и технических задач. Чем сильнее модель оптимизируют для кода и математики, тем больше разработчикам приходится отдельно учить ее объяснять мысли простым человеческим языком.
I worked on this, and Opus 5.5 is our first model model release with targeted improvements on sentence clarity and overly-dense info dumps.
It’s a hard problem to solve, and we’ll continue to make improvements. But I haven’t been as happy about a model’s writing since Opus 4.6. https://t.co/W5jVOWMnYj
Есть и менее очевидная проблема: современные модели все чаще обучаются создавать технические объяснения, предназначенные для других ИИ-моделей. Кернион говорит, что Claude оказался в некотором смысле «адаптирован к психологии LLM» и научился писать так, чтобы его хорошо понимали другие модели, а не обязательно люди. В результате ответы становятся плотными, перегруженными деталями и сложнее читаются.
Исследователь связывает это с системой вознаграждений при обучении. Одни сигналы поощряют ответы, удобные для человека, другие — эффективные для решения технических задач и взаимодействия между моделями. Если баланс смещается в пользу последних, появляется характерный стиль Claude, который пользователи прозвали Claudish.
В новой Claude Opus 5.5 Anthropic попыталась исправить проблему. По словам Керниона, это первая модель компании, которую специально дообучали делать предложения понятнее и избегать «перегруженных информацией простыней». Он добавил, что не был так доволен текстами Claude со времен Opus 4.6, хотя признал, что проблему еще предстоит дорабатывать.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.