Bitget App
Торгуйте разумнее
Купить криптовалютуРынкиТорговляФьючерсыEarnAISquareПодробнее
Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца.

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца.

华尔街见闻华尔街见闻2026/07/22 08:27
Показать оригинал
Автор:华尔街见闻

Nvidia продлевает жизненный цикл платформы Blackwell за счет постоянной оптимизации программного стека, одновременно накапливая ресурсы для масштабного внедрения следующей архитектуры Rubin.

На фоне ускоренного внедрения платформы нового поколения Rubin Nvidia раскрыла, что всего за три месяца удалось увеличить производительность GB200 NVL72 на один мегаватт при запуске модели DeepSeek R1 0528 (TPS/MW) в четыре раза. Этот результат стал возможен благодаря 38 крупным оптимизациям, реализованным Nvidia за четыре месяца и подкрепленным более чем 250 000 симуляций конфигураций и суммарно 1,4 миллионам GPU-часов валидационных испытаний.

Тем временем платформа GB300 "Blackwell Ultra" продолжает устанавливать рекорды в тестах AI-обучения. В конфигурации из 256 карт GB300 NVL72 демонстрирует рекордную производительность — 1648 TFLOPs на GPU в задаче предварительного обучения DeepSeek-V3 671B, что примерно в 3 раза выше, чем у GB200 (606 TFLOPs), причем этот показатель увеличился в 1,5 раза за последние шесть месяцев.

Значительный рост энергоэффективности GB200, оптимизация охватывает более 90% моделей

Nvidia отмечает, что серия оптимизаций для платформы GB200 NVL72 позволила за три месяца увеличить производительность на один мегаватт при запуске DeepSeek R1 0528 (конфигурация 1K вход/1K выход) в четыре раза.

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца. image 0

За этим ростом стоят 38 важных итераций оптимизации, завершенные Nvidia за четыре месяца. Они были отобраны с помощью более 250 000 симуляций конфигураций и валидацией на 1,4 миллиона GPU-часов. Особо подчеркивается, что свыше 90% внедренных оптимизаций доступны для повторного использования на других моделях в AI-продуктовой линейке компании, а не заточены только под одну задачу.

Это означает, что существующие клиенты дата-центров могут получить значительную экономию энергопотребления просто за счет обновления программного обеспечения без необходимости менять оборудование — что имеет прямую экономическую ценность для гиперскейл и корпоративных заказчиков, для которых важна стоимость вычислений.

GB300 устанавливает рекорды обучения, рост производительности за шесть месяцев — 1,5 раза

На стороне AI-обучения GB300 NVL72 демонстрирует высокую производительность: при 256-картной конфигурации и обучении модели DeepSeek-V3 671B на фреймворке Megatron Core платформа достигает 1648 TFLOPs на GPU — примерно в три раза больше, чем предыдущий показатель GB200 (606 TFLOPs), и это мировой рекорд для подобной задачи.

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца. image 1

Примечательно, что это не предел аппаратных возможностей: производительность GB300 NVL72 на Megatron Core выросла с 1088 TFLOPs/GPU в ноябре 2025 года до 1648 TFLOPs/GPU в июне 2026 года — рост в 1,5 раза за полгода.

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца. image 2

Что касается совместной оптимизации с ведущими AI-фреймворками, сотрудничество Nvidia с сообществами PyTorch и JAX также приносит значительные результаты. На TorchTitan (родной обучающий стек PyTorch) GB300 NVL72 улучшил производительность для DeepSeek-V3 671B в шесть раз — с 199 до 1197 TFLOPs/GPU по сравнению с неоптимизированной конфигурацией. Рост с JAX еще более выражен: к июлю 2026 года пропускная способность составила 4082 токена/сек на GPU (1025 TFLOPs/GPU), что примерно в 10 раз выше показателя января 2026 года (418 токенов/сек).

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца. image 3

Эффективность масштабирования приближается к теоретическому пределу, ключом служит сеть 800 Gb/s

Масштабируемость в крупных учебных AI-сценариях всегда была ключевой характеристикой AI-инфраструктуры. Nvidia сообщает, что в диапазоне от 256 до 1024 карт GB300 NVL72 во всех трех основных фреймворках достигает объема расширения, близкого к теоретическому пределу: Megatron Core — 98,5%, TorchTitan и JAX — по 97%.

Nvidia объясняет такой результат наличием в стойке NVL72 встроенного сетевого чипа Scale-Out с пропускной способностью 800 Gb/s. Высокоскоростное соединение критически влияет на расходы на коммуникации между машинами, а значит — на эффективность масштабирования в целом, и рассматривается как ключевой компонент инфраструктуры, обеспечивающий такую производительность.

Когда Rubin с нетерпением ожидается, Nvidia продолжает оптимизировать Blackwell, а энергоэффективность GB200 увеличилась в 4 раза за три месяца. image 4

Rubin ускоряет внедрение, но оптимизации Blackwell продолжаются

В момент публикации этих обновлений платформа следующего поколения Vera Rubin уже внедряется по всему миру. Согласно сообщениям, Vera Rubin NVL72 обеспечивает примерно десятикратный рост пропускной способности по токенам по сравнению с Blackwell: GB200 NVL72 — около 80 000 токенов/сек, а Vera Rubin NVL72 при той же мощности в 150 МВт — до 800 000 токенов/сек.

Тем не менее, платформа Blackwell уже внедрена во множестве дата-центров по всему миру. Стратегия Nvidia практически повторяет подход времён линейки Hopper — параллельно с развёртыванием новой платформы компания продолжает раскрывать потенциал уже установленных решений за счёт программной оптимизации. Такой подход не только продлевает срок возврата инвестиций в существующее оборудование для клиентов, но и повышает приверженность экосистеме Nvidia в сфере AI-инфраструктуры. Для рынка это значит, что при одновременном развитии Blackwell и Rubin Nvidia выстраивает программную защиту, которую конкурентам будет крайне сложно преодолеть в короткие сроки.

0
0

Дисклеймер: содержание этой статьи отражает исключительно мнение автора и не представляет платформу в каком-либо качестве. Данная статья не должна являться ориентиром при принятии инвестиционных решений.

PoolX: вносите активы и получайте новые токены.
APR до 12%. Аирдропы новых токенов.
Внести!

Вам также может понравиться

Волк показал когти, рынок облигаций поверил: кривая доходности американских облигаций выравнивается, ставки на повышение процентных ставок растут

Рынок облигаций выражает все большую уверенность в том, что председатель Федерального резервного банка Kevin Walsh выполнит свое обещание сдержать инфляцию — в настоящее время уровень инфляции уже пять лет подряд превышает целевой показатель, установленный руководством.

智通财经2026/09/17 00:51
Волк показал когти, рынок облигаций поверил: кривая доходности американских облигаций выравнивается, ставки на повышение процентных ставок растут

«Ястребиное повышение ставок»! Walsh «огромные перемены»

ФРС единогласно повысила ставку на 25 базисных пунктов в сентябре, а Уолш своими «ястребиными» действиями сдержал ястребиные обещания, четко заявив, что текущие финансовые условия не являются ужесточёнными, и это повышение ставок лишь удаляет «часть смягчения», при этом тон был жёстким. UBS считает, что функция политической реакции Уолша претерпела существенные изменения по сравнению с предшественниками — она стала более чувствительной к инфляции и к шокам предложения, при этом опасения по рынку труда заметно снизились, а порог ограничительной политики стал выше. Риски явно склоняются к сохранению высоких ставок на более длительный срок.

华尔街见闻2026/09/17 00:41

CITIC Securities: повышение ставки ФРС США в сентябре соответствует ожиданиям, цены на нефть становятся ключевым фактором, возможное дополнительное повышение ставки на 25 б.п. в этом году

Темпы и масштаб дальнейшего повышения ставок ФРС во многом зависят от цен на нефть. China International Capital Corporation ожидает, что ФРС повысит ставки еще на 25 базисных пунктов в этом году, а в следующем году, вероятно, сохранит их без изменений.

智通财经2026/09/17 00:26
CITIC Securities: повышение ставки ФРС США в сентябре соответствует ожиданиям, цены на нефть становятся ключевым фактором, возможное дополнительное повышение ставки на 25 б.п. в этом году

ФРС «ожидаемо повысила ставку», рынок волнует вопрос: «сколько раз это произойдет еще?»

Аналитики считают, что Волш подчеркнул намерение внимательно следить за инфляционными тенденциями, а до октябрьского заседания будет только один месяц данных, чего недостаточно для формирования какого-либо "тренда"; ожидается действие в декабре. Dot plot показывает, что 16 чиновников прогнозируют еще одно повышение ставки в этом году, однако доходность 10-летних казначейских облигаций США превысила 5%, и траектория ужесточения, ожидаемая трейдерами, уже более агрессивна, чем официальный dot plot.

华尔街见闻2026/09/17 00:16