В MLPerf Inference v6.1 NVIDIA подаде първите резултати на Vera Rubin NVL72 срещу GB300 NVL72: до 3,7 пъти по-голяма пропускливост на Qwen3-VL и до 2,5 пъти на DeepSeek-R1. Това е общ тест с правила, но системата е в категорията за предстоящи продукти.
- Сравнението е спрямо собственото предишно поколение на NVIDIA, на модели, които тя е избрала да подаде.
- На DeepSeek-R1 в офлайн сценария четири стелажа GB300 NVL72 дават 99 на сто ефективност на мащабиране спрямо един.
- Числото 30 пъти от теста AgentX на SemiAnalysis е подадено от NVIDIA и остава извън MLPerf.
Преди три седмици NVIDIA даде свое число за Vera Rubin, мерено на свой терен. Тогава писахме, че то чака чужда проверка.
Сега идва първото, което прилича на такава. Не съвсем, но по-близо.
Какво значи preview
MLPerf е общ изпит с общи правила: едни и същи модели, едни и същи сценарии, проверка от организатора. Затова числата оттам тежат повече от слайд. Категорията preview обаче е за системи, които още не се продават, така че изпитът е истински, а продуктът още не е на рафта.
И второто: срещу кого се мери. 3,7 пъти е спрямо собственото им предишно поколение, на модел и с настройки, които NVIDIA сама е избрала да подаде. Конкурентът изобщо не е в изречението.
Числото за 99 на сто мащабиране на сегашното поколение е по-скучното и по-полезното от всички. Четири стелажа дават в този тест почти четири пъти повече от един, тоест парите за следващия стелаж не отиват на вятъра. За който плаща тока, това е редът, който се чете първи.