Впервые раскрыта реальная производительность Vera Rubin, значительное повышение производительности! NVIDIA устроила "провокацию" перед конференцией AMD
Накануне ежегодной конференции AMD, Nvidia активно демонстрирует свои новинки: производительность процессора Vera CPU почти вдвое превышает x86-чипы при шестикратном снижении задержки, а энергоэффективность Vera Rubin NVL72 в 10 раз выше предыдущего поколения. Первые партии этих чипов уже получили такие компании, как OpenAI, Anthropic и SpaceX. Эта тщательно рассчитанная информационная атака является не только прямым ударом по AMD, но и декларацией о мощном вторжении Nvidia на рынок процессоров с целью завоевать долю в 200-миллиардной индустрии.
На кануне ежегодной презентации продуктов конкурента AMD, Nvidia нанесла мощный удар, плотно представив реальные показатели производительности своей следующей платформы Vera Rubin и официально раскрыв полные спецификации собственного CPU — чипа Vera.
Во вторник Nvidia сообщила, что производительность Vera CPU в задачах агентного AI почти вдвое выше, чем у чипов на базе x86, а задержка уменьшена в шесть раз. Одновременно облачный партнер CoreWeave в ходе раннего тестирования продемонстрировал, что платформа Vera Rubin NVL72 при запуске модели DeepSeek R1 обеспечила в 10 раз большую производительность по токенам на мегаватт вычислительной мощности, чем предыдущая система GB200 NVL72 на архитектуре Blackwell.
Время публикации этих данных выбрано неслучайно. В четверг AMD в Сан-Франциско проведет ежегодное мероприятие "Advancing AI", и массовый выпуск показателей от Nvidia большинство аналитиков расценивает как целенаправленный маркетинговый ход. Для облачных провайдеров и корпоративных клиентов, планирующих инвестиции в новое поколение AI-инфраструктуры, эти данные окажут прямое влияние на закупочные решения.
Вдобавок Nvidia официально объявила, что первая партия CPU Vera была доставлена клиентам, среди которых OpenAI, Anthropic и SpaceX, еще в июне. Это знаменует начало прямого наступления Nvidia на традиционную территорию AMD и Intel — на рынке CPU.
Дебют Vera CPU: Nvidia выходит на рынок серверных процессоров
Во вторник Nvidia представила полные спецификации своего дата-центрового процессора Vera, результаты бенчмарков и архитектурные детали — важные данные для потенциальных покупателей. Компания подтвердила: поставки чипа Vera стартовали в июне, в числе получателей — OpenAI, Anthropic и SpaceX.
Vera — первый серверный CPU от Nvidia, полностью самостоятельно спроектированный с нуля и построенный на кастомной микроархитектуре Olympus core, а не на стандартных разработках Arm.
Менеджер по продукту Vera в Nvidia, Ханна Кутанд, подчеркнула, что в центре дизайна чипа — скорость одного ядра, высокая пропускная способность памяти и низкая задержка. Главная цель — "обеспечить максимальную отдачу от GPU, чтобы агенты AI быстрее возвращались к GPU и использовали его максимально эффективно". В параметрах: энергопотребление Vera — от 250 до 450 ватт, поддержка до 1,5 ТБ энергоэффективной памяти на чип.
Согласно недавно опубликованным бенчмаркам, Nvidia показала 1,9-кратный прирост производительности Vera по сравнению с x86-чипами в задачах агентного AI и шестикратное уменьшение задержки. Компания добавила, что в некоторых индустриальных стандартах Vera обходит флагманский AMD EPYC Turin почти на 100%. Ранее Nvidia также заявляла, что Vera в задачах AI-агентов в целом эффективнее x86 на 50%.
Запуск Vera — очередной шаг Nvidia в направлении вертикальной интеграции. Wolfe Research оценивает среднюю цену чипа Vera в $5000, а ожидаемый объем отгрузок в этом году — около 1,3 млн. штук. Вице-президент Nvidia по высокомасштабируемым вычислениям Иэн Бак заявил, что агентный AI делает CPU "еще более незаменимыми", а весь серверный рынок CPU может достичь $200 млрд.
Реальные испытания Vera Rubin: десятикратный скачок энергоэффективности
В начале июня этого года CoreWeave впервые в отрасли развернула и проверила стек Vera Rubin NVL72 во всех аспектах — электропитание, охлаждение, сеть, вычисления. Представленные данные стали первыми публичными результатами по производительности кремния Vera Rubin NVL72.
Критерием теста была модель DeepSeek R1; при одинаковых целях по скорости ответа Vera Rubin NVL72 генерировала в 10 раз больше токенов на мегаватт-секунду, чем GB200 NVL72. CoreWeave также отметил, что оптимизации для Vera Rubin можно возвратно применить к GB200 NVL72 — прирост производительности на 1 мегаватт за три месяца превысил четыре раза. Nvidia подчеркнула, что результаты получены по итогам более 250 тысяч уникальных конфигураций и свыше 1,4 млн GPU-часов тестирования.
С архитектурной точки зрения, один шкаф Vera Rubin NVL72 объединяет 72 Rubin GPU и 36 Vera CPU, связанные по полностью коммутируемой архитектуре NVLink 6 с пропускной способностью 260 ТБ/с и с поддержкой NVFP4. CoreWeave отмечает: такая эффективность позволяет клиентам увеличивать объем инференса при том же энергобюджете либо снижать энергопотребление для аналогичной рабочей нагрузки, что уменьшает стоимость токена.
CoreWeave также привела реальные сценарии: одна из глобальных компаний в области кибербезопасности планирует в 10 раз повысить эффективность обнаружения угроз на ватт; предприятие в сфере автономных программных агентов — существенно снизить стоимость токена при масштабировании; AI-ориентированный поисковик рассчитывает расширить услуги мгновенного поиска на большую аудиторию, не выходя за лимиты отклика.
Инфраструктурная оптимизация: синергия железа и софта раскрывает потенциал
Nvidia делает акцент, что повышение производительности — результат не только самого чипа, но и комплексной стратегии совместной разработки аппаратного и программного обеспечения. Благодаря динамической оптимизации всего инфраструктурного и энергетического стека, Nvidia утверждает: возможно установить на 40% больше GPU при прежнем энергопотреблении.
По охлаждению используется замкнутая система жидкостного охлаждения при 45°C — это экономит примерно 4 млн галлонов воды на мегаватт в год по сравнению со стандартными решениями. В части сетей: NVLink 6 (шестого поколения) обеспечивает в 2,3 раза большую пропускную способность для языковых моделей по сравнению с Ethernet; платформа Spectrum-X дает в 1,6 раза более быструю производительность RDMA и на 1,7 раза меньше коммутаторов, увеличивает оптическую энергоэффективность в 5 раз и в 10 раз — надежность.
Новейшая платформа Spectrum-6 уже поставляется клиентам-«AI фабрикам»: CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. и Tesla. Поставки также ускоряются для Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI и CoreWeave.
Nvidia по-прежнему претендент на рынке CPU
Несмотря на впечатляющие показатели Vera, на рынке CPU Nvidia сталкивается с мощными конкурентами. По данным аналитика Gartner Кевина Нокса, главным конкурентом в секторе корпоративных AI-серверных CPU сейчас является AMD. Сообщается, что Intel удерживает около 66,8% рынка серверных процессоров, AMD — примерно 33%, и AMD продолжает завоевывать долю, укрепляя партнерство с крупнейшими облачными провайдерами.
На фоне растущего спроса на CPU для агентных AI AMD и Intel увеличили свои котировки на 128% и 149% соответственно с начала года — против 8% роста Nvidia, став ведущими «чиповыми» акциями 2026 года.
Пока что среди крупных облачных партнеров Nvidia фигурирует только Oracle, других главных игроков компания не называет. Ханна Кутанд признала: Vera «находится на ранней стадии внедрения», хотя OpenAI уже планирует начать широкое развёртывание Vera в этом квартале.
Основатель Cambrian AI Research Карл Фройнд описывает стратегию Nvidia так: «Их цель — избавить клиентов от зависимости от CPU Intel или AMD, и они настроены перехватить этот доход. Они делают ставку на уникальный процессор, аналогов которому сегодня не предлагает никто на рынке».
Дисклеймер: содержание этой статьи отражает исключительно мнение автора и не представляет платформу в каком-либо качестве. Данная статья не должна являться ориентиром при принятии инвестиционных решений.
Вам также может понравиться
Федеральная резервная система США вновь повысила процентные ставки, давление усиливается: ставки по ипотеке в США растут четвертую неделю подряд и приближаются к 7%, восстановление рынка недвижимости может быть еще больше отложено.
Согласно данным, опубликованным в четверг агентством Freddie Mac, по состоянию на 17 сентября средняя ставка по 30-летним фиксированным ипотечным кредитам в США выросла до 6,95%, по сравнению с 6,76% на прошлой неделе. Это четвертое подряд повышение и самый высокий уровень с января 2025 года.
Ночная торговля на американском рынке | Еженедельные первичные заявки на пособие по безработице в США неожиданно снизились, три основных индекса выросли, Intel (INTC.US) прибавила более 7,6%
По итогам торгов индекс Dow Jones вырос на 316,14 пункта, или на 0,61%, до 51778,04 пункта; индекс S&P 500 вырос на 85,91 пункта, или на 1,14%, до 7637,72 пункта; композитный индекс Nasdaq вырос на 439,87 пункта, или на 1,69%, до 26418,30 пункта.
Турция принимает срочные многоуровневые меры: ликвидация фондов на сумму почти 20 миллиардов долларов, арест руководителей, запрет на торговлю
Министр финансов Турции заявил, что риски “временные и контролируемые”; регуляторы планируют ликвидировать более ста фондов, управляемых семью управляющими компаниями, инвестиционные портфели затрагивают более 350 тысяч инвесторов, против 38 человек выдвинуты уголовные обвинения и введен двухлетний запрет на торговлю; несколько руководителей финансовых учреждений были арестованы, задержаны или ограничены в выезде из страны; центральный банк увеличил объем финансирования через репо, ослабил требования к капиталу банков, лимит межбанковских кредитов был увеличен в 10 раз. Индекс банков Турции в четверг вырос более чем на 9%, многие акции малой и средней капитализации продолжают падать.
Хуанг Жэньсюнь: продажи микросхем Nvidia в следующем году будут в два раза больше, чем в этом году; нельзя регулировать AI так, как регулируются социальные сети
Хуан Жэньсюнь выступает против переноса регулирования социальных медиа на искусственный интеллект, поскольку социальные медиа являются продуктом, а AI — базовой технологией, поддерживающей другие технологии и продукты. Регулирование должно касаться продукта, а не самой технологии. Он подчеркивает необходимость строгого тестирования и утверждает, что если продукт недостаточно безопасен, его выпуск следует отложить: «Безопасность AI крайне важна».
