Economia

AMD e Cerebras: una nuova era per l’inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras annunciano una partnership che promette di rivoluzionare l'inferenza AI con una soluzione disaggregata, combinando Helios e Wafer-Scale Engine.

AMD e Cerebras annunciano una nuova soluzione per l'inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI, combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.

In un’importante mossa nel settore dell’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una partnership tecnica che integra il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa collaborazione darà vita a una soluzione disaggregata per l’inferenza, che sarà disponibile attraverso Cerebras Cloud nella seconda metà del 2026.

Secondo i test interni condotti dalle due aziende, la nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T come benchmark. Questo modello, che si basa su un approccio mixture-of-experts, dispone di un trilione di parametri totali, con circa 32 miliardi di parametri attivi per token e un peso complessivo in INT4 di circa 500 GB.

Un aspetto cruciale della nuova architettura è la sua capacità di spostare la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in queste fasi. Il WSE, d’altro canto, si concentrerà sul decode e sulla generazione dei token, ottimizzando l’intero flusso di lavoro.

È interessante notare che un singolo wafer Cerebras contiene 44 GB di memoria. Pertanto, un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono essere gestiti interamente su pochi wafer WSE. Tuttavia, sarà necessario effettuare ulteriori test comparativi, soprattutto rispetto alle offerte rackscale di altri fornitori.

Nonostante l’innovazione, i termini finanziari dell’accordo non sono stati resi noti. Questa partnership arriva in un momento critico, in cui Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari. L’annuncio di AMD e Cerebras si inserisce in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.

Nel frattempo, Cerebras, che è stata quotata a maggio, ha registrato oscillazioni significative del titolo, mentre AMD continua a mostrare rialzi rilevanti del valore azionario year-to-date. Questa nuova collaborazione potrebbe rappresentare un punto di svolta per entrambe le aziende e per l’intero settore dell’intelligenza artificiale.

Autore

redazione

Redazione Diarioeconomico.