Imprese

AMD e Cerebras: Una Nuova Era per l’Inferenza con Helios e Wafer-Scale Engine

AMD e Cerebras partnership per inferenza AI

In Breve

Qual è la novità principale dell'annuncio di AMD e Cerebras?
AMD e Cerebras hanno presentato una soluzione disaggregata per l'inferenza AI, combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.

In un annuncio che promette di trasformare il panorama dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficialmente presentato una partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa collaborazione si traduce in una soluzione disaggregata per l’inferenza, che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Secondo test interni condotti dalle due aziende, la nuova architettura potrebbe garantire un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, ma con circa 32 miliardi di parametri attivi per token.

La progettazione della soluzione prevede che la fase di prefill e l’elaborazione dei prompt avvengano sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso. Il WSE, d’altra parte, si concentra sul decode e sulla generazione dei token, ottimizzando così l’intero processo di inferenza.

Un aspetto cruciale di questa innovazione riguarda la capacità di gestire modelli che non possono risiedere interamente su pochi wafer WSE. Infatti, un singolo wafer Cerebras contiene solo 44 GB di memoria, il che significa che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli più densi e compatti.

Nonostante l’entusiasmo per questa nuova partnership, è necessario condurre ulteriori test comparativi, specialmente in relazione alle offerte rackscale di altri fornitori. Le aziende non hanno divulgato i termini finanziari dell’accordo, ma il movimento arriva in un contesto di crescente attenzione degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.

Inoltre, questo annuncio giunge dopo che Nvidia ha siglato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a registrare rialzi rilevanti del valore azionario dall’inizio dell’anno.

In sintesi, la partnership tra AMD e Cerebras potrebbe segnare un punto di svolta per l’inferenza AI, offrendo prestazioni superiori e nuove opportunità per il settore.

redazione

Autore della redazione Voce Energia.

Voce all'energia. Ogni giorno.

Iscriviti alla newsletter per ricevere aggiornamenti, approfondimenti e analisi sul mondo dell'energia.