we_are_coded.by CODE · Светът, декодиран
EN
NVIDIA

Vera Rubin влезе в MLPerf с до 3,7 пъти по-висока пропускливост от предишното поколение, засега като предварителен резултат

NVIDIA Blog · събитието: 16 септември 2026Инфра

В MLPerf Inference v6.1 NVIDIA подаде първите резултати на Vera Rubin NVL72 срещу GB300 NVL72: до 3,7 пъти по-голяма пропускливост на Qwen3-VL и до 2,5 пъти на DeepSeek-R1. Това е общ тест с правила, но системата е в категорията за предстоящи продукти.

Накратко
  • Сравнението е спрямо собственото предишно поколение на NVIDIA, на модели, които тя е избрала да подаде.
  • На DeepSeek-R1 в офлайн сценария четири стелажа GB300 NVL72 дават 99 на сто ефективност на мащабиране спрямо един.
  • Числото 30 пъти от теста AgentX на SemiAnalysis е подадено от NVIDIA и остава извън MLPerf.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Преди три седмици NVIDIA даде свое число за Vera Rubin, мерено на свой терен. Тогава писахме, че то чака чужда проверка.

Сега идва първото, което прилича на такава. Не съвсем, но по-близо.

Фактите: на 16 септември 2026 г. MLCommons публикува резултатите от MLPerf Inference v6.1. По данни на NVIDIA, в първото си предварително (preview) подаване Vera Rubin NVL72 дава до 3,7 пъти по-висока пропускливост от GB300 NVL72 на Qwen3-VL, в сценариите офлайн, сървър и интерактивен, с vLLM и NVIDIA Dynamo, и до 2,5 пъти на DeepSeek-R1 с TensorRT-LLM. Резултатите са в затворената категория, записи 6.1-0106 и 6.1-0074. Подаване на DeepSeek-R1 с 288 графични процесора в четири стелажа GB300 NVL72 е постигнало 99 на сто ефективност на мащабиране в офлайн сценария спрямо един стелаж, а софтуерните оптимизации са вдигнали представянето на GB300 NVL72 на Qwen3-VL до 1,6 пъти спрямо v6.0. Nebius също е подала предварителни резултати за Vera Rubin NVL72. В същия текст NVIDIA повтаря собственото си число от теста SemiAnalysis AgentX - 30 пъти по-добро представяне от GB300 NVL72 в предварително изпитване.

Какво значи preview

MLPerf е общ изпит с общи правила: едни и същи модели, едни и същи сценарии, проверка от организатора. Затова числата оттам тежат повече от слайд. Категорията preview обаче е за системи, които още не се продават, така че изпитът е истински, а продуктът още не е на рафта.

И второто: срещу кого се мери. 3,7 пъти е спрямо собственото им предишно поколение, на модел и с настройки, които NVIDIA сама е избрала да подаде. Конкурентът изобщо не е в изречението.

Бързо спрямо себе си е добра новина за NVIDIA. Спрямо другите още не знаем.

Числото за 99 на сто мащабиране на сегашното поколение е по-скучното и по-полезното от всички. Четири стелажа дават в този тест почти четири пъти повече от един, тоест парите за следващия стелаж не отиват на вятъра. За който плаща тока, това е редът, който се чете първи.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→NVIDIA Blog - NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut, 16.09.2026→MLCommons - MLPerf Submission Rules (Preview Systems)
Оригинал: https://wearecoded.com/articles/vera-rubin-mlperf-3-7-pati-gb300.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини