in X f
Innovazione

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras Systems hanno presentato una soluzione disaggregata per l'inferenza AI, combinando Helios e Wafer-Scale Engine, promettendo prestazioni superiori.

AMD e Cerebras partnership per inferenza AI

In Breve

Qual è la novità principale dell'annuncio di AMD e Cerebras?
AMD e Cerebras hanno lanciato una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i risultati dei test interni delle due aziende?
I test indicano un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.

In un annuncio che segna un importante passo avanti nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che integra il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno riportato un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando l’open-source Kimi 2.6 1T come benchmark. Questa architettura innovativa sposta le fasi di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token e un peso completo in INT4 di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che significa che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo il miglioramento dichiarato particolarmente significativo per modelli che non possono essere completamente contenuti su pochi wafer WSE.

Nonostante i risultati promettenti, è necessario condurre ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti, ma il movimento arriva in un contesto di crescente attenzione degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.

Questo annuncio si colloca in un periodo di grande attività nel settore tecnologico, in particolare dopo che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a registrare rialzi rilevanti del valore azionario dall’inizio dell’anno.

Con questa nuova partnership, AMD e Cerebras non solo puntano a migliorare l’efficienza energetica delle loro soluzioni, ma anche a posizionarsi come leader nel competitivo mercato dell’intelligenza artificiale, dove le prestazioni e l’efficienza sono cruciali per il successo.

redazione

Autore della redazione Energia Domani.