Imprese

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras partnership per inferenza AI

In Breve

Qual è l'obiettivo della partnership tra AMD e Cerebras?
L'obiettivo è sviluppare una soluzione disaggregata per l'inferenza AI che combina Helios e Wafer-Scale Engine.
Quali sono i benefici della nuova soluzione?
La soluzione promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.
Quando sarà disponibile la soluzione sul mercato?
La soluzione sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

In un passo significativo verso l’ottimizzazione delle tecnologie per l’intelligenza artificiale, AMD e Cerebras Systems hanno annunciato una nuova partnership tecnica che combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras. Questa innovativa soluzione disaggregata per l’inferenza sarà disponibile tramite Cerebras Cloud nella seconda metà del 2026.

Durante i test interni, le due aziende hanno riportato un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura avanzata sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in questa fase del flusso di lavoro. Il WSE, invece, si concentra sul decode e sulla generazione dei token, massimizzando l’efficienza complessiva del sistema.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, di cui circa 32 miliardi attivi per token. Con un peso totale in INT4 di circa 500 GB, un singolo wafer Cerebras contiene solo 44 GB di dati. Pertanto, un’implementazione esclusivamente basata sul WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios è in grado di ospitare il modello molteplici volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono essere completamente contenuti in pochi wafer WSE.

Nonostante i risultati promettenti, le aziende hanno sottolineato la necessità di ulteriori test comparativi, specialmente rispetto alle offerte rackscale di altri fornitori. Attualmente, i termini finanziari dell’accordo non sono stati resi noti, ma il movimento avviene in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’AI.

In un momento in cui Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, l’annuncio della partnership tra AMD e Cerebras giunge come un’importante risposta alle sfide del mercato. Cerebras, quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD continua a mantenere rialzi rilevanti nel valore azionario dall’inizio dell’anno.

Questa collaborazione tra AMD e Cerebras non solo promette di migliorare le prestazioni nell’inferenza AI, ma potrebbe anche segnare un cambiamento significativo nel modo in cui le aziende affrontano le sfide legate all’efficienza energetica e alla scalabilità dei modelli AI.

redazione

Redazione e analisi sui mercati dell energia.

Tutti gli articoli ->

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *