AMD e Cerebras: Partnership Strategica per l’Inferenza AI con Soluzione Disaggregata
In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI che migliori le prestazioni energetiche.
- Quando sarà disponibile la nuova soluzione?
- La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
- Quali sono i vantaggi della nuova architettura proposta?
- La nuova architettura promette un incremento fino a cinque volte dei TPS/W rispetto a configurazioni WSE standalone.
AMD e Cerebras Systems hanno ufficialmente annunciato una partnership tecnica che integra il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovativa tecnologia sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.
Durante i test interni, le due aziende hanno registrato un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema di mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token.
L’architettura proposta prevede un’ottimizzazione del flusso di lavoro, spostando la fase di prefill e l’elaborazione dei prompt sul rack Helios. Questo approccio compensa le minori efficienze del WSE in queste fasi, permettendo al WSE di concentrarsi sul decode e sulla generazione dei token. Un singolo wafer Cerebras ha una capacità di 44 GB; pertanto, un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo la soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Il miglioramento delle prestazioni è significativo, soprattutto per modelli più densi e compatti, sebbene siano necessari ulteriori test comparativi rispetto ad altre offerte rackscale disponibili sul mercato. Non sono stati resi noti i termini finanziari della partnership, ma questo sviluppo avviene in un contesto di crescente attenzione degli investitori verso il settore dell’intelligenza artificiale.
Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’intensità della competizione nel settore. Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario dall’inizio dell’anno.

Federalismo fiscale: il decreto in Cdm senza il consenso di Regioni e Comuni