Новые разделы!
ИИ, квантовые вычисления и много других интересных тем
23.09.2026
Джексон Кернион, занимающийся в Anthropic дообучением Claude, объяснил неестественный стиль новых моделей конкуренцией целей при обучении. Оптимизация для программирования, математики и понятных другим языковым моделям технических объяснений может приводить к слишком плотным и сложным для человека ответам.
Джексон Кернион, работающий в Anthropic над дообучением Claude, объяснил, почему рост технических возможностей моделей не всегда сопровождается улучшением их письменной речи. По его словам, новые версии интенсивно обучают решать задачи по математике и программированию, а также составлять технические объяснения, которые должны хорошо восприниматься другими большими языковыми моделями.

При обучении с подкреплением конкурируют разные цели: одни награды поощряют понятность для ИИ-моделей, другие — для людей. Без дополнительного вознаграждения за простые объяснения возникает характерный для Claude стиль с перегруженными информацией и трудными для чтения ответами.
В Claude Opus 5.5 компании удалось добиться более удачного баланса, считает Кернион. Однако ориентиром по качеству письменной речи для него остается Opus 4.6; дальнейшее улучшение стиля он называет нерешенной задачей.
Источник: the-decoder.com