Инженер Anthropic Джексон Книен связал ухудшение текстов Claude с тем, как обучали новые модели. По его словам, разработчики уделяли больше внимания математике и программированию, а модели часто учились составлять технические объяснения для других ИИ. Такой текст хорошо воспринимает языковая модель, но человеку его бывает трудно читать, пишет IT之家.

Изображение к статье: Инженер Anthropic объяснил, почему Claude стал писать хуже

Книен, который занимается дообучением Claude, объясняет это механизмом вознаграждения при обучении. Ответ может помогать другой модели решить задачу, даже если для человека он перегружен деталями. По мнению инженера, чем больше внимания уделяется математике и коду, тем важнее отдельно поощрять ясные и короткие объяснения для людей.

Книен считает Opus 4.6 последней моделью Claude, чьи тексты его по-настоящему устраивали. В Opus 5.5, по его оценке, Anthropic удалось лучше сбалансировать технические способности и качество письма: работой этой модели он доволен больше, чем текстами других версий после Opus 4.6. При этом инженер не утверждает, что Opus 5.5 пишет лучше Opus 4.6.

Продолжение после рекламы

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.