I numeri pubblicati da OpenAI

OpenAI ha usato la conferenza Hot Chips 2026 del 25 agosto per presentare i primi risultati pubblici dei benchmark di Jalapeno, il chip di inferenza sviluppato con Broadcom in circa nove mesi. Nel benchmark InferenceX di SemiAnalysis su tre modelli, GPT-OSS-120B, DeepSeek R1 e Kimi K2.5, Jalapeno ha offerto da 1,5 a 1,9 volte più lavoro di IA per watt rispetto alla GB300 di Nvidia, riducendo la latenza end-to-end da 1,7 a 3,6 volte, fino a 2,1-4,1 volte sui carichi più interattivi.

Il chip ha una potenza nominale di 700 watt, ma nei carichi testati è rimasto a 550 watt o meno. Un singolo rack da 128 chip offre 1,7 exaflop di calcolo a 4 bit insieme a 27,5 terabyte di memoria HBM4, e un pod completo arriva fino a 2.048 chip. OpenAI prevede una distribuzione in piccoli volumi entro fine 2026, con crescita nel 2027.

MetricaLa dichiarazione di OpenAI
Lavoro per wattDa 1,5 a 1,9 volte in più della Nvidia GB300
Latenza end-to-endDa 1,7 a 3,6 volte inferiore alla Nvidia GB300
Potenza nominale700 watt, nei test 550 watt o meno
Tempistica di distribuzionePiccoli volumi entro fine 2026, crescita nel 2027

Perché in Europa un numero sui watt pesa più del titolo

Un guadagno di efficienza reale di questa portata conterebbe ben oltre i data center di OpenAI, perché arriva nel mezzo del dibattito europeo su se la rete elettrica possa reggere l'espansione dell'IA. Il gestore di rete irlandese ha congelato i nuovi collegamenti per data center intorno a Dublino fino al 2028, e i picchi di prezzo spot in Ungheria riportati questa settimana mostrano quanto sia già tesa la capacità di interconnessione europea; un chip che riducesse davvero del 40 per cento l'energia per unità di lavoro IA sarebbe esattamente il sollievo per quel collo di bottiglia.

Il divario è che, fuori da OpenAI, nessuno ha ancora rifatto il confronto. Il benchmark ha usato la selezione di modelli propria di OpenAI, la scelta propria di OpenAI di confrontarsi con la GB300 invece della più recente generazione Vera Rubin di Nvidia, e non è stato pubblicato alcun risultato di laboratorio indipendente accanto ad esso.

Cosa fare con un numero del fornitore stesso

Trattatela come qualsiasi team acquisti dovrebbe trattare un benchmark eseguito dal fornitore: informazione reale, da seguire, ma non ancora un dato di pianificazione. I dati di efficienza indipendenti arrivano di solito tramite risultati di inferenza MLPerf o test di laboratorio equivalenti di terze parti su hardware che il fornitore non controlla, e nessuno dei due esiste ancora per Jalapeno.

Per qualsiasi pianificatore di infrastrutture, utility o gestore di rete nella UE che riceva una richiesta di allacciamento che cita l'efficienza di una nuova generazione di chip come giustificazione di capacità, la risposta corretta è chiedere quale benchmark sostiene il numero e chi lo ha eseguito, non accettare una slide del fornitore come sostituto di un test indipendente.