In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026.
- Quali sono i risultati dei test interni?
- Un incremento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.
In un passo significativo nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una partnership tecnica che unisce il rackscale Helios di AMD al Wafer-Scale Engine (WSE) di Cerebras. Questa collaborazione mira a creare una soluzione disaggregata per l’inferenza AI, che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
I test interni condotti dalle due aziende hanno mostrato risultati promettenti, con un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema avanzato che utilizza un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso di lavoro. Questo consente al WSE di concentrarsi sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.
Un singolo wafer Cerebras, che contiene 44 GB di memoria, richiederebbe oltre una dozzina di wafer per un’implementazione esclusivamente WSE. Al contrario, un rack Helios è in grado di ospitare il modello molteplici volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Nonostante i risultati promettenti, le aziende hanno sottolineato la necessità di ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo non sono stati resi noti, ma il movimento avviene in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.
In un periodo di forte attività nel settore, è interessante notare che Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a registrare rialzi rilevanti del valore azionario year-to-date.
Questa partnership tra AMD e Cerebras rappresenta un passo avanti significativo nel campo dell’inferenza AI, con potenziali implicazioni per il futuro dello sviluppo tecnologico in questo settore in rapida evoluzione.