Bitget App
Trade smarter
Acquista CryptoMercatiTradingPerpsEarnAIPlazaAltro
Nvidia lancia la nuova generazione della piattaforma Rubin, il costo dell'inferenza è dieci volte inferiore rispetto a Blackwell, spedizioni previste per la seconda metà dell'anno

Nvidia lancia la nuova generazione della piattaforma Rubin, il costo dell'inferenza è dieci volte inferiore rispetto a Blackwell, spedizioni previste per la seconda metà dell'anno

美股ipo美股ipo2026/01/05 23:48
Mostra l'originale
Per:美股ipo
Le prestazioni di addestramento della piattaforma Rubin sono 3,5 volte superiori a quelle di Blackwell, mentre le prestazioni nell’esecuzione di software AI sono aumentate di 5 volte, e il numero di GPU richieste per addestrare modelli Mixture of Experts è stato ridotto di 4 volte. Jensen Huang ha affermato che tutti e sei i chip Rubin hanno superato i test chiave che dimostrano la loro prontezza per il dispiegamento secondo i piani. Nvidia ha dichiarato che la piattaforma è ora in piena produzione e fornitori di servizi cloud come Amazon AWS, Google Cloud, Microsoft e Oracle Cloud saranno tra i primi a implementarla.

Nvidia ha presentato la nuova generazione della piattaforma Rubin AI al CES, segnando il mantenimento di un ritmo di aggiornamento annuale nel settore dei chip per intelligenza artificiale (AI). Integrando sei nuovi chip, la piattaforma offre notevoli miglioramenti in termini di costi di inferenza ed efficienza di addestramento, e la consegna ai primi clienti è prevista per la seconda metà del 2026.

Nvidia lancia la nuova generazione della piattaforma Rubin, il costo dell'inferenza è dieci volte inferiore rispetto a Blackwell, spedizioni previste per la seconda metà dell'anno image 0

Lunedì 5, ora della costa orientale degli Stati Uniti, Jensen Huang, CEO di Nvidia, ha dichiarato a Las Vegas che i sei chip Rubin sono tornati dai partner produttivi e hanno già superato alcuni test chiave, procedendo secondo i piani. Ha sottolineato che "la corsa all'AI è iniziata, tutti stanno lavorando per raggiungere il prossimo livello". Nvidia ha evidenziato che i sistemi basati su Rubin avranno costi operativi inferiori rispetto alla versione Blackwell, poiché possono ottenere gli stessi risultati con meno componenti.

Microsoft e altri grandi fornitori di cloud computing saranno tra i primi clienti a implementare il nuovo hardware nella seconda metà dell’anno. La prossima generazione della super-fabbrica AI Fairwater di Microsoft sarà dotata del sistema rack-level Nvidia Vera Rubin NVL72, scalabile fino a centinaia di migliaia di superchip Nvidia Vera Rubin. CoreWeave sarà anch’esso tra i primi fornitori a offrire sistemi Rubin.

Il lancio della piattaforma arriva in un momento in cui una parte di Wall Street è preoccupata per l’aumento della concorrenza che Nvidia deve affrontare e mette in dubbio la sostenibilità degli attuali livelli di spesa nel settore AI. Tuttavia, Nvidia mantiene una previsione rialzista a lungo termine, stimando che il mercato totale indirizzabile possa raggiungere migliaia di miliardi di dollari.

Miglioramenti delle prestazioni per le nuove esigenze dell’AI

Secondo l’annuncio di Nvidia, le prestazioni di addestramento della piattaforma Rubin sono 3,5 volte superiori a quelle della generazione precedente Blackwell, mentre le prestazioni nell’esecuzione di software AI sono aumentate di 5 volte. Rispetto a Blackwell, Rubin può ridurre fino a 10 volte il costo di generazione dei token di inferenza e diminuire di 4 volte il numero di GPU necessarie per l’addestramento di modelli Mixture of Experts (MoE).

La nuova piattaforma è dotata della CPU Vera con 88 core, che offre prestazioni doppie rispetto ai prodotti sostitutivi. Questa CPU, progettata specificamente per l’inferenza agentica, è il processore più efficiente per le grandi fabbriche AI, dotata di 88 core personalizzati Olympus, piena compatibilità Armv9.2 e una connessione NVLink-C2C ultra-rapida.

La GPU Rubin è dotata della terza generazione di motore Transformer, con funzionalità hardware di compressione adattiva accelerata, offrendo 50 petaflops di potenza di calcolo NVFP4 per l’inferenza AI. Ogni GPU fornisce una larghezza di banda di 3,6TB/s, mentre il rack Vera Rubin NVL72 offre 260TB/s di larghezza di banda.

Test dei chip in corso con successo

Jensen Huang ha rivelato che tutti e sei i chip Rubin sono rientrati dai partner produttivi e hanno superato i test chiave che ne dimostrano la prontezza per il dispiegamento secondo i piani. Questa dichiarazione sottolinea come Nvidia mantenga la sua posizione di leader nella produzione di acceleratori AI.

La piattaforma include cinque tecnologie innovative: la sesta generazione della tecnologia di interconnessione NVLink, il motore Transformer, il confidential computing, il motore RAS e la CPU Vera. In particolare, la terza generazione della tecnologia confidential computing rende Vera Rubin NVL72 la prima piattaforma rack-level a offrire protezione dei dati cross-CPU, GPU e domini NVLink.

La seconda generazione del motore RAS copre GPU, CPU e NVLink, offrendo monitoraggio in tempo reale, tolleranza agli errori e manutenzione proattiva per massimizzare la produttività del sistema. Il rack adotta un design modulare e senza vassoi di cavi, con velocità di assemblaggio e manutenzione 18 volte superiori rispetto a Blackwell.

Ampio supporto dall’ecosistema

Nvidia ha dichiarato che Amazon AWS, Google Cloud, Microsoft e Oracle Cloud saranno tra i primi a implementare istanze basate su Vera Rubin nel 2026, seguiti dai partner cloud CoreWeave, Lambda, Nebius e Nscale.

Sam Altman, CEO di OpenAI, ha affermato: “L’intelligenza cresce con la potenza di calcolo. Più calcolo aggiungiamo, più i modelli diventano potenti, risolvendo problemi sempre più complessi e avendo un impatto maggiore sulle persone. La piattaforma Rubin di Nvidia ci aiuta a continuare questa espansione.”

Dario Amodei, cofondatore e CEO di Anthropic, ha affermato che “l’efficienza della piattaforma Rubin di Nvidia rappresenta un progresso infrastrutturale che permette una memoria più estesa, un ragionamento migliore e output più affidabili”.

Mark Zuckerberg, CEO di Meta, ha dichiarato che “la piattaforma Rubin di Nvidia promette cambiamenti radicali in termini di prestazioni ed efficienza, necessari per implementare i modelli più avanzati su scala di miliardi di persone”.

Nvidia ha inoltre dichiarato che Cisco, Dell, HPE, Lenovo e Supermicro prevedono di lanciare vari server basati su prodotti Rubin. AI lab come Anthropic, Cohere, Meta, Mistral AI, OpenAI e xAI attendono di poter utilizzare la piattaforma Rubin per addestrare modelli più grandi e potenti.

Dettagli dei prodotti annunciati in anticipo

I commentatori hanno osservato che quest’anno Nvidia ha svelato i dettagli dei nuovi prodotti prima del solito, una mossa volta a mantenere il settore dipendente dall’hardware dell’azienda. Nvidia di solito presenta in dettaglio i suoi prodotti durante l’evento GTC che si tiene ogni primavera a San Jose, California.

Per Jensen Huang, il CES è solo una delle tante tappe del suo tour maratona di eventi. Annuncerà prodotti, partnership e investimenti in vari eventi, tutti con l’obiettivo di accelerare l’adozione dei sistemi AI.

L’hardware appena annunciato da Nvidia include anche componenti di rete e connettività, destinati a far parte del supercomputer DGX SuperPod, ma disponibili anche come prodotti modulari separati per i clienti. Questo miglioramento delle prestazioni è essenziale poiché l’AI si orienta verso reti di modelli più specializzati, non solo filtrando grandi quantità di input ma anche risolvendo problemi specifici attraverso processi multi-fase.

Nvidia sta promuovendo applicazioni AI in tutti i settori economici, inclusi robotica, sanità e industria pesante. Come parte di questo sforzo, Nvidia ha annunciato una serie di strumenti volti ad accelerare lo sviluppo di veicoli a guida autonoma e robot. Attualmente, la maggior parte della spesa informatica basata su Nvidia proviene dal budget di capitale di pochi grandi clienti, tra cui Microsoft, Google Cloud di Alphabet e AWS di Amazon.

Nvidia lancia la nuova generazione della piattaforma Rubin, il costo dell'inferenza è dieci volte inferiore rispetto a Blackwell, spedizioni previste per la seconda metà dell'anno image 1
Fonte: Wall Street Visione

0
0

Esclusione di responsabilità: il contenuto di questo articolo riflette esclusivamente l’opinione dell’autore e non rappresenta in alcun modo la piattaforma. Questo articolo non deve essere utilizzato come riferimento per prendere decisioni di investimento.

PoolX: Blocca per guadagnare
Almeno il 12% di APR. Sempre disponibile, ottieni sempre un airdrop.
Blocca ora!

Ti potrebbe interessare anche

SpaceX modifica completamente il modello di costruzione dei centri dati AI: espansione rallentata, maggiore affidabilità

Secondo i media, Musk ha effettuato un’ampia riorganizzazione della dirigenza dei data center, nominando a capo un veterano del settore spaziale. Il nuovo team di gestione ha richiesto test più completi prima dell’entrata in funzione dei data center, l’installazione di ulteriori sistemi di alimentazione e raffreddamento di riserva, privilegiando una maggiore affidabilità rispetto alla velocità di costruzione. La settimana scorsa, un blackout al data center di Memphis ha causato l’arresto di alcuni modelli Grok e ha avuto un effetto a catena su clienti di affitto di capacità computazionale come Anthropic e Google.

华尔街见闻2026/09/10 18:51

Il Tesoro degli Stati Uniti completa riacquisti di titoli di Stato a lungo termine per oltre 5 miliardi di dollari, la svendita dei Treasury prosegue e il rendimento a 10 anni si avvicina al 5%

60 miliardi di dollari sono ancora limitati rispetto al mercato dei titoli di Stato statunitensi, che ha una dimensione di circa 32.000 miliardi di dollari, e non hanno raggiunto il "forte impatto" che alcuni investitori si aspettavano. Gli strateghi di Deutsche Bank hanno affermato che è come se il Tesoro avesse "creato un mostro che ora deve essere costantemente alimentato".

华尔街见闻2026/09/10 18:26

La borsa americana ha mancato le "buone notizie" davanti agli occhi? Le previsioni sui profitti sono state riviste al rialzo in modo raro, strategisti: i fondamentali sono così forti da sembrare "incredibili".

Seaport Research Partners ritiene che il mercato azionario statunitense stia affrontando una evidente divergenza tra i profitti aziendali e le performance delle azioni: gli utili del secondo trimestre sono stati solidi e le previsioni degli analisti continuano a essere riviste al rialzo, tuttavia, i timori riguardo ai tassi d'interesse elevati e alla sostenibilità degli utili stanno comprimendo le valutazioni. Settori come quello industriale e dei trasporti potrebbero presentare opportunità di mispricing. Tuttavia, se la Federal Reserve dovesse nuovamente segnalare un aumento dei tassi d'interesse, ciò potrebbe esercitare pressioni a breve termine sul mercato azionario.

华尔街见闻2026/09/10 16:16

Le elezioni di medio termine negli Stati Uniti si avvicinano, Wall Street scommette su un Congresso diviso e il mercato potrebbe godere di una pausa moderata?

Con l'avvicinarsi delle elezioni di metà mandato negli Stati Uniti, Wall Street scommette generalmente su un Congresso "diviso", con i Democratici che riacquistano la Camera dei Rappresentanti e i Repubblicani che mantengono il controllo del Senato, ritenendo che ciò possa limitare le politiche radicali e ridurre l'incertezza. I dati storici mostrano che, dal 1950, quando un presidente Repubblicano governa con un Congresso diviso, il mercato azionario degli Stati Uniti registra una crescita media annua del 13,7%, superiore all'8,3% quando il Congresso è controllato solo dai Repubblicani e al 4,9% quando è controllato solo dai Democratici. Se i risultati elettorali dovessero discostarsi dalle aspettative, il mercato potrebbe comunque subire forti fluttuazioni.

华尔街见闻2026/09/10 15:01