Nvidia annuncia Blackwell, la nuova architettura per l’IA generativa

by | 19 Mar 2024 | IA, Tecnologia

Tempo di lettura: 2 minuti

Nvidia, leader indiscusso nel settore dei chip per l’intelligenza artificiale, poche ore fa ha svelato il suo nuovo fiore all’occhiello nel campo dei chip dedicati all’IA generativa, il B200, e il “superchip” GB200.

Durante la conferenza annuale per sviluppatori, tenutasi in un’arena di hockey nel cuore della Silicon Valley. Jensen Huang, CEO di Nvidia, ha fatto una serie di annunci mirati a mantenere l’azienda in una posizione dominante nell’industria dell’intelligenza artificiale. Tra le novità presentate, il B200 spicca per essere 30 volte più veloce in alcuni compiti rispetto al suo predecessore, benché Huang non abbia fornito dettagli specifici sul prezzo del chip.

Parallelamente, Nvidia ha introdotto NIM (Nvidia Inference Microservice), un software pensato per incentivareo la scelta dei suoi chip in un mercato altamente competitivo. Questo passaggio segna la trasformazione di Nvidia da semplice produttore di chip a fornitore di piattaforme integrate, permettendo alle aziende di creare soluzioni software su misura.

Huang ha sottolinea questo cambiamento strategico, evidenziando il nuovo focus sul software come elemento centrale dell’offerta commerciale. Manuvir Das, VP Enterprise di Nvidia, ha invece dichiarato a CNBC che NIM, complementare alle GPU, arricchisce l’offerta e facilita l’uso dei modelli precedenti delle GPU Nvidia.

L’introduzione di NIM mira a rendere più accessibile l’adozione di tecnologie avanzate, offrendo un significativo valore aggiunto e permettendo un risparmio sui costi di aggiornamento hardware. Questa mossa strategica incoraggia anche l’iscrizione al programma Nvidia Enterprise, con una licenza che ha un costo di 4.500 dollari per GPU all’anno.

Il nuovo B200 offre fino a 20 petaflops di potenza di calcolo grazie ai suoi 208 miliardi di transistor. Il GB200, che combina due di queste GPU con un singolo CPU Grace, promette di offrire 30 volte la performance per carichi di lavoro di inferenza LLM, con una riduzione dei costi e del consumo energetico fino a 25 volte rispetto all’H100.

La nuova architettura Blackwell non solo accelera significativamente le prestazioni ma introduce anche miglioramenti chiave come un motore trasformatore di seconda generazione che raddoppia il calcolo, la larghezza di banda e la dimensione dei modelli di IA. Un altro avanzamento tecnologico è rappresentato dal nuovo commutatore NVLink di prossima generazione, che permette a 576 GPU di comunicare tra loro con una larghezza di banda bidirezionale di 1,8 terabyte al secondo.

Nvidia sta inoltre spingendo per l’adozione di queste tecnologie su larga scala, proponendo soluzioni come il rack GB200 NVL72 raffreddato a liquido, che integra 36 CPU e 72 GPU per un totale di 720 petaflops di performance di addestramento AI. Queste innovazioni posizionano Nvidia in modo unico per rispondere alle esigenze delle aziende di cloud computing come Amazon, Google, Microsoft e Oracle, che stanno già pianificando di offrire i rack NVL72 nei loro servizi cloud.

Nonostante l’entusiasmo per queste innovazioni, l’annuncio non ha fornito nuovo slancio a Nvidia in borsa, le cui azioni sono cresciute del 240% negli ultimi 12 mesi. Il titolo ha registrato un calo dell’1,4% nelle contrattazioni after-hours, un segnale che forse gli investitori si aspettavano annunci ancora più rivoluzionari.

Tuttavia, con le sue recenti innovazioni nel campo dei chip IA e delle infrastrutture di rete, Nvidia sembra ben posizionata per mantenere e potenzialmente espandere il suo dominio nel settore.

 

POTREBBE INTERESSARTI

Cina censura

Anche la Cina respinge lo stop all’IA: “È solo allarmismo”

Il portavoce di Pechino accusa Amodei, Altman e Musk di allarmismo sull’IA. Lo stesso giorno il ministro della sicurezza di stato cinese lancia un allarme quasi...
Donald Trump annuncerà domani World Liberty Financial

Trump respinge lo stop all’IA: “Chi vince, vince tutto”

Amodei, Altman e Musk chiedono più cautela sull’IA. Trump risponde dal golf in Irlanda: fermarsi significa regalare il vantaggio alla Cina.

Un gruppo di cybercriminali sta bloccando il mercato dell’auto americano

Negli USA l’auto vende i dati dell’utente e Washington non sembra voler far nulla

La FTC ha multato General Motors per aver venduto senza consenso i dati di guida dei clienti. Ma quasi tutte le altre case automobilistiche fanno lo stesso: la tua auto...
Claude Anthropic Apple

I governi si affidano a Claude per automatizzare la sorveglianza

Dai dossier costruiti con i dati telefonici alla selezione degli obiettivi politici, il rapporto di Anthropic mostra come l’IA stia abbassando i costi della...
Dario Amodei Anthropic Claude

Amodei, Altman e Musk chiedono di rallentare la corsa all’IA

Anthropic chiede di frenare l’aumento delle capacità dei modelli. OpenAI aderisce ai controlli indipendenti e Musk appoggia Amodei. Ma nessuno promette ancora di...
openai ia pensano

OpenAI avverte: capire cosa ‘pensano’ le IA è sempre più difficile

OpenAI ammette che seguire il ragionamento delle IA diventerà sempre più complicato perché esplicitano sempre meno il proprio ragionamento. In gioco c’è...
rubygems

OpenAI: prima di Hugging Face c’è stato RubyGems

OpenAI conferma il coinvolgimento dei propri sistemi in un incidente avvenuto a maggio. Due mesi dopo, fino a 1.200 agenti avrebbero poi attaccato Hugging Face.

pentagono

Il Pentagono entra nella filiera dell’IA con Fluidstack

Il finanziamento a Fluidstack sarebbe il più grande mai concesso dall’Office of Strategic Capital e servirebbe a produrre negli USA componenti per i data...
IA umanità Coxon

Già, ma come potrebbe davvero l’IA ucciderci tutti?

La denuncia di Coxon nei giorni scorsi ha fatto scalpore, ma come potrebbe concretizzarsi realmente il suo scenario apocalittico? Risposta: attenzione alle...
Anthropic

Anthropic accusa: Russia e Cina hanno usato Claude per cyberattacchi e distillazione

Il rapporto descrive attacchi informatici gestiti in larga parte dall’IA. E accusa Alibaba, DeepSeek, Moonshot e Xiaomi di aver cercato di replicare le capacità...
Share This