In Breve
- Qual è la novità principale dell'accordo tra AMD e Cerebras?
- L'accordo introduce una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione per l'inferenza?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Qual è il miglioramento delle prestazioni riportato?
- Le aziende segnalano un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.
AMD e Cerebras Systems hanno annunciato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovativa tecnologia sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un miglioramento significativo delle prestazioni, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo incremento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello avanzato di machine learning.
L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in questa fase del flusso di lavoro. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.
Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Con un peso complessivo in INT4 di circa 500 GB, un singolo wafer Cerebras contiene 44 GB di memoria. Pertanto, un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo la soluzione particolarmente vantaggiosa per modelli che non possono essere completamente gestiti da pochi wafer WSE.
Nonostante i risultati promettenti, le aziende hanno sottolineato che sono necessari ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori. Inoltre, non sono stati resi noti i termini finanziari dell’accordo tra AMD e Cerebras.
Questa collaborazione avviene in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale.
Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario year-to-date.

