У ході масштабного дослідження, що охопило понад 309 815 діалогів, команда розробників виявила фундаментальну особливість поведінки мовних моделей: зміна мови спілкування кардинально змінює не лише словниковий запас, а й саму систему цінностей, яку демонструє нейромережа. Найяскравіше цей феномен проявився під час аналізу російськомовних сесій.

Фахівці звели понад 3000 раніше ідентифікованих цінностей Claude до чотирьох ключових осей: Поступливість проти Обережності, Теплота проти Суворості, Глибина проти Стислості та Відвертість проти Результативності. Саме ці шкали пояснюють 15% усієї варіативності в поведінці моделі. Ключовий висновок: профіль цінностей змінюється не лише між різними моделями, а й, що набагато важливіше, між 20 найпопулярнішими мовами платформи.

Російська мова як полюс суворості

Найбільш значні коливання відбуваються по осі «Теплота vs. Суворість» та «Відвертість vs. Результативність». Російська мова разом з англійською зайняла крайне положення на полюсі суворості. Це означає, що під час спілкування російською Claude значно частіше поводиться як прискіпливий рецензент, а не як підбадьорливий співрозмовник. Він активно оскаржує вихідні передумови, виправляє деталі, вимагає доказів і дає критичний розбір.

Для порівняння, арабською та гінді модель зміщується до максимальної теплоти, демонструючи ввічливість, гумор та схвалення ідей користувача. Практичний наслідок очевидний: один і той самий бізнес-план отримає зовсім різну оцінку залежно від мови запиту. Російськомовний користувач з високою ймовірністю зіткнеться з жорсткою критикою та вимогами обґрунтувань, тоді як користувач гінді — з м'якою та заохочувальною реакцією.

Модель теж має значення

Важливо розуміти, що мова — не єдиний фактор. Вибір конкретної версії моделі також накладає відбиток:

  • Sonnet 4.6 схиляється до поступливості, теплоти та стислості, часто схвалюючи ідеї та використовуючи гумор.
  • Opus 4.7 зміщується до обережності та глибини, оскаржуючи хибні передумови та даючи відверту критику.
  • Opus 4.6 займає проміжну позицію з ухилом у суворість, поступливість та стислість.

Дослідники поки не можуть точно визначити причину цих відмінностей. Основна гіпотеза — нерівномірний розподіл навчальних даних за мовами. Там, де даних багато, досягти однаковості цінностей простіше. Крім того, склад текстів різними мовами відрізняється: професійні корпуси можуть нести інші ціннісні настанови, ніж розмовні.

Мій експертний коментар: Для криптоіндустрії та DeFi-сектору, де точність формулювань і критичний аналіз мають першорядне значення, така «суворість» російськомовного Claude — радше перевага, ніж недолік. Однак розробникам і користувачам важливо враховувати цей мовний зсув, щоб уникнути непорозумінь під час оцінки складних технічних рішень. Компанія Anthropic планує впровадити профілювання цінностей у процес оцінки та моніторингу моделей, що дозволить краще контролювати цю ненавмисну варіативність. Питання про те, наскільки така варіативність бажана, залишається відкритим, але для криптоспільноти, звиклої до high-risk середовища, суворий і вимогливий ШІ-асистент може виявитися набагато кориснішим за «теплого» співрозмовника.