Economia

AMD e Cerebras: una partnership innovativa per l’inferenza AI

AMD e Cerebras Systems hanno unito le forze per sviluppare una nuova soluzione disaggregata per l'inferenza AI, promettendo prestazioni significativamente migliorate.

Luglio 29, 2026di Redazione

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Sviluppare una soluzione disaggregata per l'inferenza AI.
Quando sarà disponibile la nuova soluzione?
Nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
Fino a cinque volte l'incremento dei token per secondo per watt rispetto a configurazioni precedenti.

AMD e Cerebras Systems hanno annunciato una collaborazione tecnica che combina il rackscale Helios di AMD con il Wafer‑Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. Questa innovazione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Secondo test interni condotti dalle due aziende, la nuova architettura offre un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa soluzione si distingue per la sua capacità di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in queste fasi, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Il peso completo del modello in INT4 è di circa 500 GB. Un singolo wafer Cerebras contiene 44 GB, il che implica che un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer. Al contrario, un rack Helios può ospitare il modello molte volte, rendendo il miglioramento delle prestazioni particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE.

Questa innovazione è particolarmente rilevante per il settore dell’intelligenza artificiale, dove la capacità di gestire modelli più densi e compatti è cruciale. Tuttavia, è importante notare che serviranno ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori.

Non sono stati resi noti i termini finanziari dell’accordo tra AMD e Cerebras. Questo sviluppo arriva in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore AI. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale.

Inoltre, Cerebras, che è stata quotata in borsa a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mantenere rialzi rilevanti del valore azionario dall’inizio dell’anno. Questa partnership potrebbe rappresentare un passo importante per entrambe le aziende nel consolidare la loro posizione nel mercato dell’intelligenza artificiale.

Economia Tecnologia

Continua a leggere