В топ рейтинга ИИ попала модель правительства Рио-де-Жанейро на основе Qwen

В топ рейтинга ИИ попала модель правительства Рио-де-Жанейро на основе Qwen — Tech | Versia.media

На рынке LLM произошла неожиданная смена лидеров. Бразильская IT-компания IplanRIO, находящаяся в собственности правительства Рио-де-Жанейро, выпустила open-source новинку Rio 3.5 Open 397B.

Изначально сообщалось, что разработчики дообучили китайскую Tongyi Qwen 3.5 от Alibaba и сумели создать решение, которое сразу вошло в мировой топ-10 рейтинга ИИ, потеснив флагманские коммерческие системы — однако за этим успехом скрывался совершенно иной технический аспект.

Архитектура и масштаб модели

Как модель привлекла внимание общественности? Всё дело в её масштабе — RIO 3.5 основана на архитектуре с 397 млрд параметров и использует схему «смеси экспертов». В процессе генерации активируется часть параметров — 17 млрд на токен. Такой подход позволяет достичь производительности флагманских моделей, поскольку архитектура данной модели аналогична большинству наиболее успешных решений.

Хотя основное соперничество в развитии нейросетей идёт между Китаем и США, Бразилия громко заявила о себе — RIO развивается по схеме, которая приносит успех многим открытым моделям: за основу берутся готовая архитектура и передовые наработки, которые затем модифицируются для улучшения качества работы.

Главные плюсы

Среди основных преимуществ (по заявлению разработчиков) можно выделить следующее:

интеграция SwiReasoning с возможностью динамического переключения между явным выводом и выводом в латентном пространстве для достижения оптимального баланса между точностью и эффективностью;

интеграция SwiReasoning с возможностью динамического переключения между явным выводом и выводом в латентном пространстве для достижения оптимального баланса между точностью и эффективностью;

отличные результаты в рассуждении, выполнении команд и мультимодальных задачах, наравне с известными моделями;

отличные результаты в рассуждении, выполнении команд и мультимодальных задачах, наравне с известными моделями;

хорошее понимание многих языков — результаты на английском, китайском и других языках находятся на высоком уровне;

хорошее понимание многих языков — результаты на английском, китайском и других языках находятся на высоком уровне;

лицензия MIT, которая снимает с открытого кода ограничения, такие как запрет на коммерческое использование или модификацию.

лицензия MIT, которая снимает с открытого кода ограничения, такие как запрет на коммерческое использование или модификацию.

Ключевое, на мой взгляд, преимущество — огромная длина контекста. Rio 3.5 поддерживает контекст в 1 млн токенов. Это позволяет анализировать крупные тексты и большие объёмы кода, исследовательские материалы, научные работы и другие длинные тексты без необходимости постоянно разбивать информацию на части, как это бывает в том же ChatGPT.

Облачная инфраструктура для ваших проектов

Виртуальные машины в Москве, Санкт-Петербурге и Новосибирске с оплатой по потреблению.

Подробнее →

Недостатки и требования к железу

Из недостатков можно отметить:

слишком большую перегруженность модели — использовать такую архитектуру можно, но для этого требуются серьёзные вычислительные ресурсы; полноценный запуск такой модели остаётся недоступным для обычных пользователей;

слишком большую перегруженность модели — использовать такую архитектуру можно, но для этого требуются серьёзные вычислительные ресурсы; полноценный запуск такой модели остаётся недоступным для обычных пользователей;

для запуска Rio 3.5 в оригинальном качестве (FP16) потребуется около 880 ГБ VRAM — это четыре серверных чипа Blackwell Ultra; даже со сжатием (INT4) модели нужно не менее 220 ГБ видеопамяти, так что на домашнем ПК её не развернуть;

для запуска Rio 3.5 в оригинальном качестве (FP16) потребуется около 880 ГБ VRAM — это четыре серверных чипа Blackwell Ultra; даже со сжатием (INT4) модели нужно не менее 220 ГБ видеопамяти, так что на домашнем ПК её не развернуть;

необкатанную модель — преимущества основаны на результатах тестировщиков и разработчиков, обычные пользователи пока не составили мнения о модели.

необкатанную модель — преимущества основаны на результатах тестировщиков и разработчиков, обычные пользователи пока не составили мнения о модели.

Правда, почти сразу разразился скандал. Исследователи из Nex-AGI заявили, что бразильцы модель вообще не обучали, а сделали чистый математический мерж весов оригинальной Qwen 3.5 и их собственной Nex-N2 Pro. Более того, когда у Rio стёрли системный промпт, она начала отвечать: «Я — Nex». IplanRIO уже извинились на Hugging Face, сославшись на то, что инженеры случайно загрузили не тот файл.

Хотя модель за счёт интеграции SwiReasoning и выдаёт результаты сильнее базовой Qwen 3.5, конкурируя по ряду тестов с закрытыми флагманами, до фундаментального технологического прорыва она не дотягивает. Однако бесконечно штамповать подобные решения без потери качества невозможно — этот блендинг сработал только благодаря близкой архитектурной генетике исходных моделей, чьи веса идеально подошли друг другу.

Что в итоге

Теперь не только Китай удивляет своими интересными решениями в области ИИ, но и Бразилия. Хотя США и является лидером по выручке, монополия в области создания нейросетей сходит на нет. Благодаря открытым базовым моделям, новым методам дообучения и более эффективным архитектурам в борьбу за лидерство будут вступать новые игроки.

Время покажет, сможет ли IplanRIO выпустить свою финальную очищенную версию, но сам прецедент с Rio 3.5 уже стал предметом главных обсуждений в Кремниевой долине. История показала, что open-source сообщество способно мгновенно выводить на рынок сильные решения и так же быстро выводить их создателей на чистую воду, подпитывая огонь конкуренции среди больших языковых моделей.

Протестировать Rio 3.5 Open 397B уже можно через страницу модели на Hugging Face.

← Tech