In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è combinare Helios e Wafer-Scale Engine per migliorare l'efficienza energetica nell'inferenza AI.
Quando sarà disponibile la nuova soluzione disaggregata?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Qual è il miglioramento previsto in termini di efficienza?
Si prevede un incremento fino a cinque volte dei token per secondo per watt rispetto a configurazioni WSE standalone.

AMD e Cerebras Systems hanno annunciato una partnership tecnica che promette di rivoluzionare il campo dell’inferenza nell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, offrendo una soluzione disaggregata che sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, la nuova architettura potrebbe garantire un incremento di fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.

La struttura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in questa fase, mentre il WSE si concentra sul decode e sulla generazione dei token. Un singolo wafer Cerebras contiene 44 GB, e un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.

Nonostante i risultati promettenti, le aziende riconoscono la necessità di ulteriori test comparativi, soprattutto rispetto ad altre offerte rackscale presenti sul mercato. Inoltre, non sono stati resi noti i termini finanziari dell’accordo, ma il movimento arriva in un contesto di crescente attenzione degli investitori verso il settore dell’intelligenza artificiale.

Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date.

Questa innovazione rappresenta un passo avanti significativo nella ricerca di soluzioni più efficienti e scalabili per l’intelligenza artificiale, un settore in rapida evoluzione e sempre più cruciale per il futuro tecnologico.