In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- L'obiettivo è combinare Helios e Wafer-Scale Engine per migliorare l'efficienza e le prestazioni nell'inferenza AI.
- Quando sarà disponibile la soluzione disaggregata?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura proposta?
- La nuova architettura offre un incremento delle prestazioni fino a cinque volte in termini di TPS/W rispetto a configurazioni WSE standalone.
In un annuncio che segna un passo significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Le due aziende hanno condotto test interni che mostrano un incremento delle prestazioni fino a cinque volte in termini di token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello che utilizza una architettura mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’architettura proposta prevede lo spostamento della fase di prefill e dell’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in quella fase del flusso di lavoro. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token. Questo approccio è particolarmente vantaggioso per modelli complessi che non possono essere gestiti da pochi wafer WSE, richiedendo invece un’infrastruttura più robusta come quella offerta dal rack Helios.
Un singolo wafer Cerebras ha una capacità di 44 GB, il che implica che un’implementazione esclusivamente basata su WSE necessiterebbe di oltre una dozzina di wafer per gestire un modello di tale complessità. Al contrario, il rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente interessante per le aziende che lavorano con modelli di intelligenza artificiale di grandi dimensioni.
Tuttavia, è importante notare che ulteriori test comparativi sono necessari per valutare l’efficacia di questa soluzione rispetto a quelle offerte da altri fornitori nel settore rackscale. Non sono stati resi noti i termini finanziari dell’accordo tra AMD e Cerebras, ma il movimento arriva in un contesto di crescente attenzione degli investitori verso il finanziamento circolare nel settore dell’AI.
Questo annuncio segue un recente accordo di Nvidia per una licenza non esclusiva sulla tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del suo titolo, mentre AMD continua a mantenere un trend rialzista nel valore azionario dall’inizio dell’anno.
In conclusione, la partnership tra AMD e Cerebras rappresenta un passo importante verso l’ottimizzazione delle prestazioni nell’inferenza AI, promettendo di ridefinire gli standard del settore e di favorire l’adozione di modelli sempre più complessi e performanti.

