AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine
In Breve
- Qual è la nuova soluzione lanciata da AMD e Cerebras?
- Una soluzione disaggregata per l'inferenza AI che combina Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova architettura?
- Nella seconda metà del 2026 tramite Cerebras Cloud.
- Quali sono i vantaggi della nuova architettura?
- Un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni standalone.
AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. La nuova architettura sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
In test interni, le due aziende hanno riportato prestazioni impressionanti, con un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello che utilizza un approccio mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’architettura proposta sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in questa parte del flusso di lavoro. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.
Un singolo wafer Cerebras ha una capacità di 44 GB, e un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer per gestire il modello completo. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Nonostante i risultati promettenti, è necessario condurre ulteriori test comparativi, specialmente rispetto ad altre offerte rackscale disponibili sul mercato. Inoltre, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti, lasciando aperte domande su come questa partnership influenzerà il mercato.
Questa notizia arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, il che evidenzia l’importanza strategica di tali innovazioni nel panorama tecnologico attuale.
Inoltre, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario year-to-date. Questi sviluppi suggeriscono un futuro dinamico e competitivo nel settore dell’intelligenza artificiale, con AMD e Cerebras in prima linea.
