Nvidia создает открытую модель с триллионом параметров, и она все равно будет меньше, чем китайская.
Nvidia выпустила Nemotron 3.5 Lightning во вторник. Это модель с 30 миллиардами параметров, использующая смесь экспертов, из которых три миллиарда активны в любой момент времени. Архитектура является гибридом Mamba-2, MoE и слоев внимания, с контекстным окном в один миллион токенов. Веса находятся на Hugging Face и ModelScope.
Лицензия - это то, что имеет значение. Она поставляется под OpenMDW-1.1, что позволяет коммерческое использование, и Nvidia опубликовала данные для обучения и рецепты вместе с весами. Компании могут бесплатно загружать, использовать и модифицировать без запроса разрешения или оплаты Nvidia, отмечает CNBC.
Заявление о скорости имеет два числа
Nvidia лидирует по скорости вывода до четырех раз по сравнению с моделями аналогичного размера. Если читать дальше, то агентная цифра более скромная. На PinchBench она достигла 86% точности, завершив 10,000 задач на 30% быстрее, чем Qwen 3.6 35B от Alibaba при аналогичной точности.
Оба числа находятся в одном релизе. Четыре раза быстрее описывают генерацию токенов в лаборатории. Тридцать процентов - это то, что происходит, когда модель действительно выполняет задачу. Этот разрыв стоит учитывать всякий раз, когда поставщик указывает пропускную способность.
Оценки бенчмарков достойные, а не шокирующие. Она показывает 81.94 на MMLU Pro, 75.44 на GPQA Diamond и 51.56 на SWE-bench Verified. Предварительное обучение составило более 20 триллионов токенов.
Роутер - это настоящий продукт
Nvidia также выпустила NeMo Switchyard, библиотеку с открытым исходным кодом. Она отправляет каждый шаг рабочего процесса агента к той модели, которая справляется с ним лучше всего. Планы маршрутизируют до фронтирной модели. Исполнение маршрутизируется до Lightning.
LangChain протестировала его на 145 задачах, в цифрах, собранных MarkTechPost. Маршрутизация между Lightning и Claude Opus 4.8 снизила затраты на 74% по сравнению с использованием только фронтирной модели. Только 7% вызовов пришлись на дорогую модель, с потерей примерно шести пунктов точности.
Это не призыв быть лучшей моделью. Это призыв обрабатывать 93% вызовов. Nvidia утверждает, что большая часть работы агента не требует фронтирной модели. Это аргумент о товаризации, направленный прямо на лаборатории.
Почему компания по производству чипов раздает модели
Мотив не таинственен, и Nvidia никогда его не скрывала. Более дешевые, свободно доступные модели означают больше вывода, а вывод работает на GPU. Товаризация программного обеспечения расширяет рынок для аппаратного обеспечения, на котором оно основано.
Мы сообщали о той же логике, когда Nvidia связала свою работу по безопасности с спросом на чипы. Она также ставит модели под подпись. Nvidia подписала письмо с открытыми весами, призывающее Вашингтон не вводить ограничения. Дженсен Хуанг сделал свой первый пост в X, чтобы продвигать это. OpenAI, Anthropic и Google не подписали.
Модель с триллионом параметров и уловка
The Information сообщает, что Nvidia строит Nemotron 4 с более чем триллионом параметров. Это больше, чем 550 миллиардов Nemotron 3 Ultra. Она может быть готова уже в конце осени. Компания хочет, чтобы она конкурировала с лучшими открытыми моделями в мире.
Вот строка, которую все пропустят. Даже с триллионом параметров Nemotron 4 все равно будет меньше, чем ведущие китайские открытые модели. Kimi K3 от Moonshot уже держит рекорд как самая большая открытая модель, когда-либо выпущенная.
Таким образом, амбиция - это догонять, а не лидировать. Nvidia строит в сторону размера, который Китай прошел первым, и говорит об этом в своем брифинге.
Китай задал этот темп и все еще его держит
Сравнение, которое Nvidia выбрала для своего собственного бенчмарка, было китайской моделью. Lightning соперничает с Qwen 3.6, а не с какой-либо американской открытой моделью. На этом уровне Qwen - это то, что нужно побить.
DeepSeek провела год, снижая цены на открытые модели, пока запуск чего-либо менее способного не стал иметь смысла. Alibaba и Moonshot обменивались первыми местами в открытых чартах. Американские открытые веса были политическим аргументом большую часть этого времени, а не товаром.
Nemotron 3.5 Lightning немного меняет это. Это настоящая модель, действительно открытая, от компании, которая продает лопаты.
На что обратить внимание вместо бенчмарков
Nvidia уже ранее выпустила модели Nemotron, включая Nemotron Nano Omni для крайних агентов. Ни одна из них не сместила центр тяжести открытых весов от китайских лабораторий.
Тестом будет Nemotron 4, и у него есть примерная дата. Скажем, он выйдет в конце осени и займет первое место в открытых чартах. Nvidia получит место за столом, который в настоящее время только финансирует. Скажем, он снова займет второе место после Kimi. Честное описание стратегии тогда - это генерация спроса на GPU.
Обе интерпретации могут быть верными одновременно. Это как раз и есть суть раздачи программного обеспечения, когда вы продаете аппаратное обеспечение.
Другие статьи
Nvidia создает открытую модель с триллионом параметров, и она все равно будет меньше, чем китайская.
Nemotron 3.5 Lightning от Nvidia бесплатен и быстр. Запланированный триллионный параметр Nemotron 4 все еще будет отставать от ведущих китайских открытых моделей.
