Новые разделы!
ИИ, квантовые вычисления и много других интересных тем

Заходите в ЦИТадель!
Век живи — век учись

Разработчик Anthropic связал ухудшение стиля Claude с оптимизацией под код и другие ИИ-модели

Джексон Кернион, занимающийся в Anthropic дообучением Claude, объяснил неестественный стиль новых моделей конкуренцией целей при обучении. Оптимизация для программирования, математики и понятных другим языковым моделям технических объяснений может приводить к слишком плотным и сложным для человека ответам.

Джексон Кернион, работающий в Anthropic над дообучением Claude, объяснил, почему рост технических возможностей моделей не всегда сопровождается улучшением их письменной речи. По его словам, новые версии интенсивно обучают решать задачи по математике и программированию, а также составлять технические объяснения, которые должны хорошо восприниматься другими большими языковыми моделями.

Фрагмент обсуждения Джексона Керниона о стиле Claude

При обучении с подкреплением конкурируют разные цели: одни награды поощряют понятность для ИИ-моделей, другие — для людей. Без дополнительного вознаграждения за простые объяснения возникает характерный для Claude стиль с перегруженными информацией и трудными для чтения ответами.

В Claude Opus 5.5 компании удалось добиться более удачного баланса, считает Кернион. Однако ориентиром по качеству письменной речи для него остается Opus 4.6; дальнейшее улучшение стиля он называет нерешенной задачей.

Источник: the-decoder.com

Связь с редакцией