Jalapeño è il chip di OpenAI in collaborazione con Broadcom

by | 25 Giu 2026 | Tecnologia, IA

Foto: OpenAI
Riassunto IA
  • Jalapeño è il primo chip di OpenAI con Broadcom, dedicato all’inferenza: Tan dichiara a Bloomberg un taglio dei costi per token del 50%.
  • Project Nexus può arrivare a 180 miliardi di dollari; la prima fase da 18 miliardi è condizionata alla garanzia di Microsoft sul 40% dei chip (The Information), non ancora concessa.
  • La produzione su scala slitta al 2027 e l’annuncio arriva alla vigilia della quotazione di OpenAI attesa nel 2026.
Tempo di lettura: 3 minuti

Ieri i vertici di Broadcom, Hock Tan e Charlie Kawwas, hanno consegnato a Sam Altman e Greg Brockman un wafer di silicio. Sopra c’era Jalapeño, il primo processore progettato da OpenAI e costruito per fare una cosa sola: eseguire l’inferenza, cioè far girare i modelli già addestrati ogni volta che un utente digita una richiesta.

L’azienda lo chiama “Intelligence Processor” e annuncia prestazioni per watt “sostanzialmente migliori” rispetto allo stato dell’arte. Per ora resta una rivendicazione, perché i numeri definitivi non sono stati diffusi e il rapporto tecnico arriverà soltanto nei prossimi mesi.

OpenAI: nove mesi e un volano

Tra il disegno e il tape-out, ossia l’invio del progetto alla fonderia, sono passati nove mesi. OpenAI lo descrive come il ciclo di sviluppo più rapido di cui sia a conoscenza per un ASIC ad alte prestazioni (Application-Specific Integrated Circuit, un circuito progettato per un compito solo), a fronte di tempi che di norma vanno da un anno e mezzo a due.

Parte del merito, sostiene l’azienda, va ai suoi stessi modelli, che sarebbero stati impiegati per accelerare la progettazione. È l’argomento che OpenAI ripete da tempo: controllare tutta la filiera, dall’architettura del chip ai kernel fino alla memoria e alla rete, permette di ottimizzare ogni livello attorno allo stesso obiettivo.

“Progettando da soli una parte maggiore della filiera possiamo servire più intelligenza con maggiore efficienza”, ha dichiarato Brockman.

Chi c’è dietro

Il chip su misura è in realtà un’opera a più mani. OpenAI firma il progetto, Broadcom fornisce l’implementazione del silicio e la tecnologia di rete (compresi gli switch Tomahawk), mentre Celestica si occupa di schede, rack e integrazione dei sistemi. La produzione è affidata a TSMC, sul nodo a 3 nanometri.

Il punto più delicato, però, riguarda il denaro. Il programma, che porta il nome in codice di Project Nexus, prevede acceleratori per 10 gigawatt entro il 2029, con un costo che nella sola produzione dei chip può arrivare a 180 miliardi di dollari (circa 158 miliardi di euro).

La prima fase ne vale 18 (circa 16 miliardi di euro), ed è qui che entra in scena Microsoft. Secondo una ricostruzione di The Information, Broadcom avrebbe condizionato il finanziamento alla garanzia che Redmond acquisti circa il 40% dei chip, e finora Microsoft non ha firmato.

Un dirigente di OpenAI, Sachin Katti, ha bollato in un messaggio interno come “finanziariamente poco attraente” proprio questa subordinazione a Microsoft.

A regime nel 2027

Jalapeño nasce per ridurre il peso di una voce che cresce di continuo. L’inferenza è ciò che accade a ogni uso di ChatGPT o di Codex, e moltiplicata per centinaia di milioni di richieste diventa la spesa che decide i conti.

Tan ha detto a Bloomberg che il chip abbatte di circa il 50% il costo per token rispetto alle GPU attuali, e a Reuters che le prestazioni sono allineate a quelle dei Blackwell di Nvidia e dei TPU di Google. Il pre-addestramento, invece, continuerà a poggiare sull’hardware di Nvidia, più costoso e più generalista.

Il momento del lancio non è casuale. OpenAI prepara la quotazione in borsa attesa per il 2026, dopo un anno in cui i costi di ricerca e sviluppo hanno superato i 19 miliardi di dollari (circa 17 miliardi di euro), più della metà della spesa complessiva. A chi guarda ai conti, un chip che promette inferenza più economica racconta che una strada verso la redditività esiste.

Tan, dal canto suo, raffredda le aspettative sui tempi e spiega che nel 2026 si vedranno soltanto “piccoli prototipi”, mentre la produzione vera e propria comincerà nel 2027.

Brockman ricorda perché tutta l’operazione serve: “Non riusciamo a procurarci potenza di calcolo abbastanza in fretta”, e Tan rincara descrivendo una domanda “semplicemente insaziabile”. Eppure, per affrancarsi da Nvidia, OpenAI ha bisogno che a garantire sia Microsoft, lo stesso socio da cui sta provando a rendersi più indipendente.

Fonte: TechCrunch

POTREBBE INTERESSARTI

Cina censura

Anche la Cina respinge lo stop all’IA: “È solo allarmismo”

Il portavoce di Pechino accusa Amodei, Altman e Musk di allarmismo sull’IA. Lo stesso giorno il ministro della sicurezza di stato cinese lancia un allarme quasi...
Donald Trump annuncerà domani World Liberty Financial

Trump respinge lo stop all’IA: “Chi vince, vince tutto”

Amodei, Altman e Musk chiedono più cautela sull’IA. Trump risponde dal golf in Irlanda: fermarsi significa regalare il vantaggio alla Cina.

Un gruppo di cybercriminali sta bloccando il mercato dell’auto americano

Negli USA l’auto vende i dati dell’utente e Washington non sembra voler far nulla

La FTC ha multato General Motors per aver venduto senza consenso i dati di guida dei clienti. Ma quasi tutte le altre case automobilistiche fanno lo stesso: la tua auto...
Claude Anthropic Apple

I governi si affidano a Claude per automatizzare la sorveglianza

Dai dossier costruiti con i dati telefonici alla selezione degli obiettivi politici, il rapporto di Anthropic mostra come l’IA stia abbassando i costi della...
Dario Amodei Anthropic Claude

Amodei, Altman e Musk chiedono di rallentare la corsa all’IA

Anthropic chiede di frenare l’aumento delle capacità dei modelli. OpenAI aderisce ai controlli indipendenti e Musk appoggia Amodei. Ma nessuno promette ancora di...
openai ia pensano

OpenAI avverte: capire cosa ‘pensano’ le IA è sempre più difficile

OpenAI ammette che seguire il ragionamento delle IA diventerà sempre più complicato perché esplicitano sempre meno il proprio ragionamento. In gioco c’è...
rubygems

OpenAI: prima di Hugging Face c’è stato RubyGems

OpenAI conferma il coinvolgimento dei propri sistemi in un incidente avvenuto a maggio. Due mesi dopo, fino a 1.200 agenti avrebbero poi attaccato Hugging Face.

pentagono

Il Pentagono entra nella filiera dell’IA con Fluidstack

Il finanziamento a Fluidstack sarebbe il più grande mai concesso dall’Office of Strategic Capital e servirebbe a produrre negli USA componenti per i data...
IA umanità Coxon

Già, ma come potrebbe davvero l’IA ucciderci tutti?

La denuncia di Coxon nei giorni scorsi ha fatto scalpore, ma come potrebbe concretizzarsi realmente il suo scenario apocalittico? Risposta: attenzione alle...
Anthropic

Anthropic accusa: Russia e Cina hanno usato Claude per cyberattacchi e distillazione

Il rapporto descrive attacchi informatici gestiti in larga parte dall’IA. E accusa Alibaba, DeepSeek, Moonshot e Xiaomi di aver cercato di replicare le capacità...
Share This