In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quali sono i miglioramenti delle prestazioni riportati?
- Le due aziende riportano un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
In un annuncio che segna un passo significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica che unisce le forze del rackscale Helios di AMD e del Wafer-Scale Engine (WSE) di Cerebras. Questa nuova soluzione disaggregata per l’inferenza sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno riportato un incremento notevole delle prestazioni, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T.
L’architettura proposta prevede un’innovativa distribuzione dei compiti: la fase di prefill e l’elaborazione dei prompt sono gestite dal rack Helios, mentre il WSE si concentra sul decode e sulla generazione dei token. Questo approccio consente di compensare le minori efficienze del WSE in alcune fasi del processo, ottimizzando così l’intero flusso di lavoro.
Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token. Il peso completo del modello in formato INT4 è di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB di memoria, il che implica che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios ha la capacità di ospitare il modello molteplici volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Nonostante i risultati promettenti, gli esperti avvertono che sono necessari ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori, per valutare appieno il potenziale di questa nuova architettura.
Non sono stati resi noti i dettagli finanziari dell’accordo tra AMD e Cerebras. Tuttavia, l’annuncio arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha siglato un accordo per una licenza non esclusiva sulla tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale.
Inoltre, Cerebras, quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD ha mantenuto rialzi rilevanti del valore azionario dall’inizio dell’anno. Questi sviluppi suggeriscono un clima di grande dinamismo nel settore della tecnologia AI, con aziende che cercano di posizionarsi in modo strategico per affrontare le sfide future.
