Зміна мови спілкування безпосередньо впливає на те, які цінності та який характер демонструє нейромережа. Дослідники з Anthropic провели масштабний аналіз, який показав: під час спілкування російською мовою модель Claude помітно зміщується в бік суворості та критичності, втрачаючи звичну теплоту, властиву їй іншими мовами.
У рамках роботи під назвою «Claude’s Values Across Models and Languages» експерти звели понад 3000 раніше виявлених цінностей моделі до чотирьох основних осей поведінки. Вони виміряли, як змінюється профіль цих цінностей між різними версіями ШІ та 20 найпопулярнішими мовами платформи Claude.ai. Російська мова в цьому дослідженні посіла особливе місце — поряд з англійською, вона виявилася полюсом, де Claude проявляє максимальну суворість на шкоду теплоті. Давайте розберемося, що це означає на практиці.
Чотири осі, за якими вимірюють характер ШІ
Дослідники виділили чотири ключові осі, кожна з яких являє собою числову шкалу між двома протилежними групами цінностей:
| Назва осі | Крайні точки поведінки ШІ |
| Deference vs. Caution | Поступливість (йти назустріч користувачеві) проти Обережності (захищати від ризику та шкоди) |
| Warmth vs. Rigor | Теплота (позитивний настрій та турбота) проти Суворості (акцент на точності та критиці) |
| Depth vs. Brevity | Глибина (розгорнуте пояснення) проти Стислості (виконання рівно того, про що попросили) |
| Candor vs. Execution | Відвертість (визнання власної невизначеності) проти Результату (впевнена відповідь) |
Ці чотири осі пояснюють 15% усієї варіативності в цінностях, які виражає Claude. Фахівці прагнули виміряти саме цінності моделі, а не відмінності в самих запитах. Для цього вони контролювали тему, завдання та цінності, виражені користувачем у кожному з 309 815 проаналізованих діалогів.
Що відбувається при переході на російську
Найсильніше профіль цінностей Claude змінюється між мовами за осями Warmth vs. Rigor та Candor vs. Execution. За осями Deference vs. Caution та Depth vs. Brevity він залишається найбільш стабільним. Російська мова розташувалася на суворому полюсі першої осі. Найсильніше до суворості на шкоду теплоті Claude схиляється саме в англійській та російській. На протилежному кінці знаходяться арабська та гінді, де модель максимально зміщується до теплоти.
Суворість у виконанні Claude — це конкретний набір поведінок. Нейромережа починає оскаржувати вихідні передумови користувача, виправляти деталі та запитувати докази. Теплота ж іншими мовами проявляється через ввічливі формулювання, гумор та грайливість, а також схвалення ідей та роботи людини. Іншими словами, російською Claude частіше поводиться як прискіпливий рецензент, а не як підбадьорливий співрозмовник.
Практичні наслідки автори ілюструють прикладом. Дві людини просять зворотний зв'язок щодо одного й того ж бізнес-плану — одна мовою гінді, інша російською. Вони можуть винести різне враження про його якість, тому що Claude висловить різні цінності у формулюванні оцінки. Російськомовний користувач з більшою ймовірністю отримає критичний розбір з виправленнями та вимогою обґрунтувань. Іншими мовами той самий план зустрів би більш м'яку та заохочувальну реакцію.
Мова — не єдиний фактор
Модель Claude також впливає на профіль цінностей, причому відмінності між моделями та мовами вимірюються одним методом. Наприклад, Sonnet 4.6 схиляється до поступливості, теплоти та стислості, часто схвалюючи ідеї користувача та вдаючись до гумору. Opus 4.7, навпаки, зміщується до обережності та глибини: оскаржує хибні передумови, попереджає про ризики, дає відверту критику та пояснює свої міркування. Opus 4.6 займає проміжну позицію з ухилом у суворість, поступливість та стислість. На підсумкову поведінку накладаються як мова розмови, так і обрана модель.
Самі дослідники поки не знають, чим саме викликані ці відмінності. Одне з припущень — нерівномірний розподіл навчальних даних за мовами. Там, де даних багато, досягти однаковості цінностей простіше. Склад текстів різними мовами теж відрізняється, і професійні тексти можуть нести інші цінності. Відкритим залишається і питання про те, наскільки така варіативність бажана. Різні мови несуть різні розмовні норми, і частина відмінностей може відображати їх, а частина — прогалину в якості обслуговування мовних спільнот.
Думка експерта: Для криптоіндустрії та технологічного сектору цей висновок має пряме значення. Якщо ви розробляєте ШІ-продукт для глобальної аудиторії, ви повинні розуміти, що його «характер» і стиль взаємодії будуть відрізнятися залежно від мови. Це може впливати на сприйняття бренду, рівень довіри і навіть на результати A/B-тестування. Компаніям варто закладати моніторинг ціннісних профілів у свої процеси, щоб ненавмисні зрушення не стали сюрпризом.