К содержанию
Выпуск №8 · 16 июня 2026 / Новости

Платформа NVIDIA Blackwell показала лучшие результаты в бенчмарке MLPerf Training 6.0

Платформа NVIDIA Blackwell заняла лидирующие позиции во всех категориях бенчмарка MLPerf Training 6.0, серии отраслевых тестов с рецензированием для оценки производительности обучения ИИ.

Редакция 16 июня 2026 г., 19:33 MSK

В Telegram

Платформа NVIDIA Blackwell заняла лидирующие позиции во всех категориях бенчмарка MLPerf Training 6.0, серии отраслевых тестов с рецензированием для оценки производительности обучения ИИ. По опубликованным результатам система показала самое быстрое время обучения на каждом бенчмарке. Зафиксирован и крупнейший масштаб обучения: 8,192 GPUs на системах NVIDIA Blackwell NVL72. Кроме того, это единственная платформа, представившая результаты по всем семи тестам набора.

В MLPerf Training 6.0 появились и две новые MoE‑нагрузки для предобучения: DeepSeek-V3 671B и GPT-OSS-20B. NVIDIA опубликовала результаты для систем NVIDIA GB200 NVL72 и GB300 NVL72. Внутри каждой rack-scale системы коммутаторы пятого поколения NVIDIA NVLink Switches объединяют 72 GPUs с высокой пропускной способностью, создавая общий пул вычислений и памяти. Компания также продемонстрировала методы обучения NVFP4. Они применяются как при крупномасштабном, так и при маломасштабном предобучении и fine-tuning; этот подход, например, использовался при предобучении модели NVIDIA Nemotron 3 Ultra с 550-billion-parameter.

В тестах производительности система NVIDIA GB300 NVL72 показала до 1.6x более быстрое обучение по сравнению с GB200 NVL72 при том же масштабе. Для распределённого обучения компания предлагает две сетевые платформы масштабирования, NVIDIA Quantum InfiniBand и NVIDIA Spectrum-X Ethernet. В рамках бенчмарка NVIDIA масштабировала обучение DeepSeek-V3 671B до 8,192 GPUs на системах GB200 NVL72. Также были представлены результаты на 5,120 GPUs для Llama 3.1 405B.

В результаты вошли и проекты партнёров. Microsoft Azure масштабировала обучение Llama 3.1 405B до 8,192 GPUs на системах GB200 NVL72 и достигла reference quality target за 7.07 minutes. Это самое быстрое время обучения для данного бенчмарка. CoreWeave показала лучший результат для DeepSeek-V3 671B: quality target достигнут за 2.02 minutes при масштабе 8,192 GPUs на системах GB300 NVL72, подключённых через Spectrum-X Ethernet.

Ключевые факты

  • В бенчмарке MLPerf Training 6.0 платформа NVIDIA Blackwell показала самое быстрое время обучения на всех семи тестах и была единственной платформой с результатами по всем семи бенчмаркам набора.

  • В тесте DeepSeek‑V3 671B компания масштабировала обучение до 8,192 GPU с использованием систем NVIDIA GB200 NVL72, это крупнейшая подача на базе Blackwell в истории MLPerf Training.

  • Система NVIDIA GB300 NVL72 в этом раунде показала до 1.6x более быстрое обучение по сравнению с GB200 NVL72 при том же масштабе.

  • Microsoft Azure обучила Llama 3.1 405B на 8,192 GPU с системами GB200 NVL72 и достигла целевого качества за 7.07 минуты, а CoreWeave обучила DeepSeek‑V3 671B за 2.02 минуты на 8,192 GPU с использованием GB300 NVL72 и сети Spectrum‑X Ethernet.

Как процитировать

«Платформа NVIDIA Blackwell показала лучшие результаты в бенчмарке MLPerf Training 6.0». hegai.media, 16 июня 2026 г.. https://hegai.media/novosti/platforma-nvidia-blackwell-pokazala-luchshie-rezultaty-v-benchmarke-ml--b1eee223-b2c6-4725-a126-cf2015d3656b

так материал выглядит в мессенджере