Support us

Claude стал умнее, но начал писать хуже — инженер Anthropic объяснил почему

Новые версии Claude лучше справляются с кодом, математикой и сложными рассуждениями, но из-за этого их тексты стали менее естественными и понятными для людей. Причину объяснил сотрудник Anthropic Джексон Кернион, который занимается дообучением Claude.

Оставить комментарий
Claude стал умнее, но начал писать хуже — инженер Anthropic объяснил почему

Новые версии Claude лучше справляются с кодом, математикой и сложными рассуждениями, но из-за этого их тексты стали менее естественными и понятными для людей. Причину объяснил сотрудник Anthropic Джексон Кернион, который занимается дообучением Claude.

По его словам, одна из причин — смещение обучения в сторону программирования и технических задач. Чем сильнее модель оптимизируют для кода и математики, тем больше разработчикам приходится отдельно учить ее объяснять мысли простым человеческим языком.

Есть и менее очевидная проблема: современные модели все чаще обучаются создавать технические объяснения, предназначенные для других ИИ-моделей. Кернион говорит, что Claude оказался в некотором смысле «адаптирован к психологии LLM» и научился писать так, чтобы его хорошо понимали другие модели, а не обязательно люди. В результате ответы становятся плотными, перегруженными деталями и сложнее читаются.

Исследователь связывает это с системой вознаграждений при обучении. Одни сигналы поощряют ответы, удобные для человека, другие — эффективные для решения технических задач и взаимодействия между моделями. Если баланс смещается в пользу последних, появляется характерный стиль Claude, который пользователи прозвали Claudish.

В новой Claude Opus 5.5 Anthropic попыталась исправить проблему. По словам Керниона, это первая модель компании, которую специально дообучали делать предложения понятнее и избегать «перегруженных информацией простыней». Он добавил, что не был так доволен текстами Claude со времен Opus 4.6, хотя признал, что проблему еще предстоит дорабатывать.

Claude Code теперь работает и после закрытия ноутбука — подписчикам дают до $250
Claude Code теперь работает и после закрытия ноутбука — подписчикам дают до $250
По теме
Claude Code теперь работает и после закрытия ноутбука — подписчикам дают до $250
GPT-6 Astra Claude Fable и Grok посадили за руль Toyota. Угадайте кто доехал до финиша
GPT-6 Astra, Claude Fable и Grok посадили за руль Toyota. Угадайте, кто доехал до финиша
По теме
GPT-6 Astra, Claude Fable и Grok посадили за руль Toyota. Угадайте, кто доехал до финиша
Подрядчиков OpenAI увольняют за использование ИИ при обучении ИИ
Подрядчиков OpenAI увольняют за использование ИИ при обучении ИИ 
По теме
Подрядчиков OpenAI увольняют за использование ИИ при обучении ИИ
Читайте также
Anthropic: Claude шантажирует, потому что вы все слишком много пишете о «злом» ИИ
Anthropic: Claude шантажирует, потому что вы все слишком много пишете о «злом» ИИ
Anthropic: Claude шантажирует, потому что вы все слишком много пишете о «злом» ИИ
Anthropic выпустила Claude Opus 4.8: ИИ чаще признаёт ошибки и лучше работает с кодом
Anthropic выпустила Claude Opus 4.8: ИИ чаще признаёт ошибки и лучше работает с кодом
Anthropic выпустила Claude Opus 4.8: ИИ чаще признаёт ошибки и лучше работает с кодом
Anthropic: Claude пишет 80% нашего кода и ускорил разработку в 8 раз
Anthropic: Claude пишет 80% нашего кода и ускорил разработку в 8 раз
Anthropic: Claude пишет 80% нашего кода и ускорил разработку в 8 раз
3 комментария
Anthropic выпустила гайд по Claude Opus 5.5: советует писать меньше промптов
Anthropic выпустила гайд по Claude Opus 5.5: советует писать меньше промптов
Anthropic выпустила гайд по Claude Opus 5.5: советует писать меньше промптов

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.