mercoledì 29 Luglio 2026
Seguici su
Economia

AMD e Cerebras: Una Nuova Frontiera nell’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras Systems annunciano una partnership per una soluzione disaggregata nell'inferenza AI, combinando Helios e Wafer-Scale Engine.
Di Economia, Tecnologia
AMD e Cerebras annunciano una nuova soluzione per l'inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quali sono i benefici attesi dalla nuova architettura?
Fino a cinque volte l'aumento dei token per secondo per watt rispetto a una configurazione WSE standalone.
Quando sarà disponibile la soluzione sul mercato?
Nella seconda metà del 2026 tramite Cerebras Cloud.

In un’epoca in cui l’intelligenza artificiale (AI) sta diventando sempre più centrale nel panorama tecnologico, AMD e Cerebras Systems hanno recentemente annunciato una partnership strategica. Questa collaborazione mira a combinare il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI che sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, la nuova architettura promette un aumento significativo delle prestazioni, con un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di AI che utilizza un trilione di parametri totali, ma attiva solo circa 32 miliardi per token.

La struttura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in queste fasi. Il WSE, d’altro canto, si concentra sul decode e sulla generazione dei token, ottimizzando il flusso di lavoro complessivo. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.

Questa innovazione è particolarmente significativa per i modelli di AI più complessi e densi, che necessitano di una maggiore capacità di elaborazione. Tuttavia, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori nel settore.

Nonostante l’entusiasmo per questa nuova soluzione, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti. Questo annuncio arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, un segno delle dinamiche competitive in atto.

Inoltre, Cerebras, che è stata quotata in borsa a maggio, ha mostrato oscillazioni significative del titolo, mentre AMD continua a registrare rialzi rilevanti nel valore azionario dall’inizio dell’anno. Questo scenario evidenzia l’importanza crescente delle tecnologie AI nel mercato attuale e la competizione tra le principali aziende del settore.

In conclusione, la partnership tra AMD e Cerebras rappresenta un passo avanti significativo nell’evoluzione delle soluzioni per l’inferenza AI. Con l’implementazione di Helios e WSE, le due aziende si posizionano come attori chiave in un mercato in rapida evoluzione, promettendo di migliorare l’efficienza e le prestazioni delle applicazioni AI nel prossimo futuro.

Resta aggiornato sui temi che contano.

Iscriviti alla nostra newsletter quotidiana.