Смена языка общения кардинально меняет не только словарный запас нейросети Claude, но и саму систему её ценностей. Масштабное исследование, проведённое разработчиками, показало: в русскоязычной версии модель демонстрирует заметно более строгий и критический характер, утрачивая привычную теплоту и эмпатию, свойственную, например, арабскому или хинди.
Аналитики свели более 3000 выявленных ценностных ориентиров Claude к четырём ключевым осям поведения. Эти оси — Уступчивость vs. Осторожность, Теплота vs. Строгость, Глубина vs. Краткость и Откровенность vs. Результативность — объясняют 15% всей вариативности в ответах модели. Для чистоты эксперимента контролировались тема, задача и ценности, заложенные пользователем в каждом из 309 815 проанализированных диалогов.
Четыре оси измерения поведения ИИ
Наиболее драматичные изменения профиля Claude происходят именно на осях «Теплота vs. Строгость» и «Откровенность vs. Результативность». Именно здесь русский язык занял крайнюю позицию. В паре с английским, Claude на русском демонстрирует максимальную склонность к строгости в ущерб теплоте. На противоположном полюсе — арабский и хинди, где модель максимально смещена к теплоте и поддержке.
Что это значит на практике? Строгость Claude на русском — это конкретный набор поведенческих паттернов: нейросеть начинает оспаривать исходные предпосылки пользователя, исправлять детали и требовать доказательства. Теплота же, проявляющаяся в других языках, выражается через вежливые формулировки, юмор, игривость и одобрение идей собеседника. Иными словами, на русском Claude ведёт себя как придирчивый рецензент, а не как ободряющий собеседник.
Авторы исследования пока не могут точно определить причину такого разрыва. Основная гипотеза — неравномерное распределение обучающих данных по языкам. Там, где данных много, добиться единообразия ценностей проще. Кроме того, сам состав текстов на разных языках различается: профессиональные и академические корпуса, преобладающие в русскоязычном сегменте, могут нести иные ценностные нагрузки.
Разработанный метод профилирования ценностей Anthropic планирует внедрить в оценку и мониторинг всех будущих моделей — до и после релиза. Это позволит отлавливать неожиданные сдвиги и сопоставлять их с проблемным поведением. Главный же вывод сегодняшнего дня очевиден: ценности Claude различаются способами, которые разработчики не выбирали намеренно, и разбираться с этой вариативностью компания намерена вплотную.
Мнение эксперта: Данное исследование — тревожный сигнал для всей индустрии. Если ИИ-ассистент на русском языке системно склонен к критике и строгости, это может искажать восприятие пользователями качества продукта и создавать неравные условия для русскоязычного сообщества. Проблема не в самом языке, а в качестве и структуре обучающих данных. И пока Anthropic разбирается с этим, пользователям стоит учитывать: их запрос на русском может быть встречен не поддержкой, а строгим анализом.