Rio 3.5: Скандал з «унікальною» ШІ-моделлю від мерії Ріо-де-Жанейро

Муніципальна IT-компанія Ріо-де-Жанейро IplanRIO представила Rio 3.5 Open 397B, стверджуючи, що це відкрита ШІ-модель, навчена за державні кошти та перевершує DeepSeek V4 Pro і Qwen 3.7 Plus за низкою бенчмарків. Однак вже наступного дня команда розробників ШІ Nex заявила, що інструмент є прямим злиттям їхньої власної моделі Nex-N2-Pro та Qwen3.5-397B-A17B.
Після цих претензій IplanRIO оперативно оновила картку моделі на Hugging Face. У новій версії зазначено, що Rio 3.5 побудована через злиття Nex-N2-Pro та Qwen3.5-397B-A17B з подальшою дистиляцією від сильнішої моделі.
Як представляли Rio 3.5
IplanRIO виклала Rio 3.5 Open 397B на Hugging Face 13 червня 2026 року під ліцензією MIT. У початковому описі проєкт називали ШІ-системою загального призначення «передового рівня» та вказували, що модель донавчена на базі Qwen3.5-397B-A17B. Характеристики включали 397 млрд параметрів, з яких 17 млрд активуються при обробці кожного токена (архітектура Mixture-of-Experts), контекстне вікно на 1,01 млн токенів та використання фреймворку SwiReasoning. У першій версії картки наводилися результати тестів, за якими Rio 3.5 обходила конкурентів: на Terminal-Bench 2.1 — 70,8% проти 70,3% у Qwen 3.7 Plus та 67,9% у DeepSeek V4 Pro; у Humanity’s Last Exam — 36,5% проти 34,7% у Qwen 3.7 Plus; у IMOAnswerBench — 89,5%.
Що заявила Nex
14 червня Nex відкрила звернення в репозиторії Nex-N2 на GitHub, заявивши, що ваги Rio 3.5 виглядають як пряме поелементне злиття Nex-N2-Pro та Qwen3.5-397B-A17B. За оцінкою Nex, Rio 3.5 приблизно на 60% складається з Nex-N2-Pro та на 40% з Qwen3.5-397B-A17B. Компанія не знайшла ознак самостійного навчання IplanRIO. Два ключові аргументи: після видалення системного промпту «You are Rio» модель називала себе «Nex, from Nex-AGI» у 79% відповідей, і кожен тензор ваг Rio повторює пропорцію 0,6/0,4 між Nex та Qwen у всіх 60 шарах моделі. «Невинного пояснення цьому немає», — йдеться в заяві Nex.
Чому бенчмарки викликали питання
Nex-N2-Pro у власних тестах показує вищі результати, ніж Rio 3.5: 75,3% на Terminal-Bench 2.1 проти 70,8% у Rio 3.5, та 1585 балів на GDPval проти 1533. Якщо Rio дійсно є сумішшю, її слабші результати виглядають очікувано. Після оновлення картки ці бенчмарки прибрали з основного опису.
Як відповіла IplanRIO
Після претензій IplanRIO змінила README моделі, вказавши, що Rio 3.5 побудована через злиття Nex-N2-Pro та Qwen3.5-397B-A17B, а потім пройшла дистиляцію. «Ми шкодуємо про плутанину та приносимо вибачення», — йдеться в оновленому README. Команда працює над повторним завантаженням коректної моделі. Окремого розгорнутого публічного коментаря на момент публікації не було.
У чому суть спору
Використання відкритих моделей (Nex-N2-Pro під ліцензією Apache 2.0, Qwen3.5-397B-A17B — відкрита модель) саме по собі не є порушенням. Спір виник через презентацію: початкова картка створювала враження самостійної розробки та донавчання на базі Qwen, але не вказувала Nex-N2-Pro як одне з джерел. У open-source-спільноті це сприймають як проблему прозорості. Злиття відкритих ваг та дистиляція стали звичайною практикою, але від розробників очікують розкриття вихідних моделей та внеску сторонніх команд.
Мій коментар: Цей інцидент — яскравий приклад того, як у гонці за лідерство в ШІ страждає прозорість. Для криптоспільноти, де верифікація та докази — основа довіри, такий підхід неприпустимий. Якби IplanRIO з самого початку чесно вказала джерела, скандалу б не було. Натомість ми бачимо спробу видати комбінацію відкритих моделей за власний прорив, що підриває довіру не лише до проєкту, а й до державних ініціатив у цій сфері.