Русская версия The Next Web

Deep Tech Искусственный интеллект США

Nvidia создает открытую модель с триллионом параметров, и она все равно будет меньше китайских

Nvidia создает открытую модель с триллионом параметров, и она все равно будет меньше китайских

Во вторник Nvidia выпустила Nemotron 3.5 Lightning. Это смесь экспертов (mixture-of-experts) с 30 миллиардами параметров, из которых в любой момент времени активны три миллиарда. Архитектура представляет собой гибрид слоев Mamba-2, MoE и механизмов внимания с окном контекста в один миллион токенов. Веса модели доступны на Hugging Face и ModelScope.

Лицензия — это то, что действительно имеет значение. Модель поставляется под лицензией OpenMDW-1.1, которая разрешает коммерческое использование, а Nvidia опубликовала данные обучения и рецепты вместе с весами. Компании могут бесплатно скачивать, использовать и модифицировать модель без необходимости запрашивать разрешение или платить Nvidia, отмечает CNBC.

Заявление о скорости состоит из двух цифр

Nvidia лидирует по скорости генерации текста, которая до четырех раз превышает показатели моделей сопоставимого размера. Если читать дальше, то показатель для агентских задач выглядит скромнее. В бенчмарке PinchBench модель достигла точности 86%, выполнив 10 000 задач на 30% быстрее, чем Qwen 3.6 35B от Alibaba при аналогичной точности.

Обе цифры приведены в одном релизе. «В четыре раза быстрее» описывает генерацию токенов в лабораторных условиях. «Тридцать процентов» — это то, что происходит, когда модель действительно выполняет реальную работу. Этот разрыв стоит учитывать всякий раз, когда поставщик заявляет о пропускной способности.

Результаты бенчмарков скорее достойные, чем поразительные. Модель набирает 81,94 балла на MMLU Pro, 75,44 на GPQA Diamond и 51,56 на SWE-bench Verified. Предварительное обучение заняло более 20 триллионов токенов.

Маршрутизатор — это настоящий продукт

Nvidia также выпустила библиотеку с открытым исходным кодом NeMo Switchyard. Она направляет каждый шаг рабочего процесса агента на ту модель, которая справляется с ним лучше всего. Планирование маршрутизируется на пограничную (frontier) модель. Исполнение маршрутизируется вниз на Lightning.

LangChain протестировала систему на 145 задачах, согласно данным, собранным MarkTechPost. Маршрутизация между Lightning и Claude Opus 4.8 снизила затраты на 74% по сравнению с использованием только пограничной модели. Лишь 7% вызовов ушло на дорогую модель, что стоило примерно шести пунктов точности.

Это не заявка на звание лучшей модели. Это заявка на обработку 93% запросов. Nvidia утверждает, что для большинства агентских задач не нужна пограничная модель. Это аргумент в пользу коммодитизации, направленный прямо против лабораторий.

Почему производитель чипов раздает модели бесплатно

Мотив не таинственен, и Nvidia никогда его не скрывала. Более дешевые и общедоступные модели означают больше инференса, а инференс работает на графических процессорах. Коммодитизация программного обеспечения расширяет рынок для лежащего в его основе аппаратного обеспечения.

Мы сообщали о той же логике, когда Nvidia увязала свою работу по безопасности со спросом на чипы. Это также ставит модели за подписью разработчика. Nvidia подписала письмо об открытых весах, призывающее Вашингтон не закручивать гайки. Дженсен Хуанг сделал свой первый в истории пост в X в поддержку этого документа. OpenAI, Anthropic и Google не подписали его.

Модель с триллионом параметров и подводные камни

The Information сообщает, что Nvidia создает Nemotron 4 с количеством параметров более одного триллиона. Это больше, чем 550 миллиардов у Nemotron 3 Ultra. Модель может быть готова уже поздней осенью. Компания хочет, чтобы она конкурировала с лучшими открытыми моделями в мире.

А вот та строчка, которую все пропустят. Даже при наличии триллиона параметров Nemotron 4 все равно будет меньше ведущих китайских открытых моделей. Kimi K3 от Moonshot уже удерживает рекорд как самая большая открытая модель из когда-либо выпущенных.

Так что это амбиция догнать, а не лидерство. Nvidia движется к созданию модели того масштаба, который Китай уже преодолел, и сама заявляет об этом в своей презентации.

Китай задал этот темп и до сих пор удерживает его

Для собственного бенчмарка Nvidia выбрала в качестве сравнения китайскую модель. Lightning соревнуется с Qwen 3.6, а не с какой-либо американской открытой моделью. При таком размере Qwen — это то, с чем нужно соревноваться.

Компания DeepSeek весь год снижала цены на открытые модели до тех пор, пока запуск чего-то менее эффективного не потерял всякий смысл. Alibaba и Moonshot поочередно занимали верхние строчки открытых чартов. Американские открытые веса большую часть этого времени оставались предметом политических споров, а не готовым продуктом.

Nemotron 3.5 Lightning меняет это в небольшой степени. Это реальная модель, по-настоящему открытая, от компании, которая продает лопаты во «время золотой лихорадки».

За чем следить вместо бенчмарков

Nvidia уже выпускала модели Nemotron раньше, в том числе Nemotron Nano Omni для периферийных агентов. Ни одна из них не сместила центр тяжести открытых весов в сторону от китайских лабораторий.

Главным испытанием станет Nemotron 4, у которого есть примерные сроки выхода. Предположим, она появится поздней осенью и возглавит открытые чарты. В этом случае Nvidia купит себе место за столом, работу которого она сейчас лишь спонсирует. Предположим, она снова окажется позади Kimi. Тогда честное описание стратегии сведется к генерации спроса на графические процессоры.

Обе трактовки могут быть верны одновременно. В этом и заключается суть бесплатной раздачи программного обеспечения, когда вы продаете железо.