In Breve
- Qual è la novità principale dell'annuncio di AMD e Cerebras?
- Le due aziende hanno lanciato una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura?
- La nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.
AMD e Cerebras Systems hanno ufficializzato una collaborazione tecnica che segna un passo avanti significativo nel campo dell’intelligenza artificiale. Combinando il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, le due aziende stanno introducendo una soluzione disaggregata per l’inferenza, che sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
In test interni, le aziende hanno registrato un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando l’open-source Kimi 2.6 1T. Questa architettura innovativa sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella fase, mentre il WSE si concentra sul decode e sulla generazione dei token.
Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token e un peso complessivo in INT4 di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios ha la capacità di ospitare il modello molte volte, rendendo il miglioramento particolarmente significativo per modelli che non possono essere contenuti su pochi wafer WSE.
È importante notare che ulteriori test comparativi saranno necessari, specialmente rispetto ad altre offerte rackscale di fornitori concorrenti. Non sono stati divulgati i termini finanziari dell’accordo, ma questa mossa strategica arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.
Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario dall’inizio dell’anno. Questo sviluppo potrebbe rappresentare una svolta importante nel panorama competitivo dell’AI, in particolare dopo che Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari.

