Economia

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
Creare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i risultati dei test interni delle due aziende?
I test mostrano un aumento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.

AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che segna un passo importante nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza AI. La nuova tecnologia sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno riportato risultati promettenti, evidenziando un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando il modello open-source Kimi 2.6 1T, un sistema che utilizza un trilione di parametri, ma solo circa 32 miliardi di parametri attivi per token.

L’architettura proposta permette di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in quella parte del flusso di lavoro. Il WSE, invece, si concentra sul decode e sulla generazione dei token, ottimizzando l’intero processo di inferenza.

Un aspetto cruciale da considerare è che un singolo wafer Cerebras contiene 44 GB di memoria. Pertanto, un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios è in grado di ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli complessi che non possono essere contenuti in pochi wafer WSE.

Nonostante i risultati promettenti, le aziende hanno sottolineato la necessità di ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo non sono stati resi noti, lasciando aperte alcune domande sul valore commerciale della partnership.

Questa notizia arriva in un contesto di crescente attenzione da parte degli investitori verso il settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica delle innovazioni tecnologiche in questo campo.

Nel frattempo, Cerebras, che è stata quotata in borsa a maggio, ha mostrato oscillazioni significative del titolo, mentre AMD continua a mantenere un trend di rialzo nel valore azionario dall’inizio dell’anno. Questo sviluppo potrebbe rappresentare un punto di svolta per entrambe le aziende, posizionandole come leader nel mercato dell’intelligenza artificiale e dell’inferenza.

Autore

redazione

Redazione AtlanteMercati.