В Anthropic объяснили, почему новые Claude могут писать менее естественно

Инженер Anthropic Джексон Кернион связывает менее естественный стиль Claude с оптимизацией под код и технические объяснения. По его словам, Opus 5.5 нашла лучший баланс, но проблема не решена.

Модель может учиться писать для других моделей

Джексон Кернион, инженер Anthropic, работающий над дообучением Claude, объяснил, почему рост возможностей моделей в математике, программировании и рассуждении не всегда сопровождается улучшением письма. По его словам, новые версии оптимизируют под технические объяснения, понятные другим языковым моделям. Для людей такой стиль может выглядеть перегруженным и трудным для чтения.

Кернион связывает эффект с целевыми сигналами обучения с подкреплением. Одни награды улучшают понимание текста моделями, другие — его понятность людям. Чем сильнее обучение на математике и коде, тем важнее дополнительно поощрять ясные объяснения для человеческого читателя.

Anthropic говорит о прогрессе, но не о решении проблемы

Кернион назвал Opus 4.6 последней моделью Anthropic, которую считал особенно сильной в письме. О новой Opus 5.5 он отозвался лучше, чем о других версиях после Opus 4.6, и сказал, что компания нашла более удачный баланс.

При этом инженер не утверждает, что Opus 5.5 превзошла прежнюю модель в качестве текста. Он назвал задачу сложной и отметил, что Anthropic продолжит улучшения. Вывод основан на оценке сотрудника компании, а не на независимом сравнительном тесте.

Anthropic engineer explains why Claude's writing got worse although the model got smarter