Economia

AMD e Cerebras: Una Nuova Era per l’Inferenza AI con Helios e Wafer-Scale Engine

AMD e Cerebras Systems presentano una soluzione innovativa per l'inferenza AI, combinando Helios e Wafer-Scale Engine per migliorare le prestazioni.

redazione Luglio 29, 2026 Economia, Innovazione

In Breve

Qual è la novità della partnership tra AMD e Cerebras?
La partnership introduce una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
Quando sarà disponibile la nuova soluzione?
La soluzione sarà disponibile nella seconda metà del 2026.
Quali sono i vantaggi della nuova architettura?
La nuova architettura promette un aumento fino a cinque volte dei token per secondo per watt rispetto a configurazioni precedenti.

AMD e Cerebras Systems hanno recentemente annunciato una partnership tecnica che segna un passo significativo nel campo dell’intelligenza artificiale. Questa collaborazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, creando una soluzione disaggregata per l’inferenza. La disponibilità di questa nuova tecnologia è prevista per la seconda metà del 2026 attraverso Cerebras Cloud.

Durante i test interni, le due aziende hanno registrato un aumento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone, utilizzando il modello open-source Kimi 2.6 1T. Questa architettura innovativa sposta la fase di prefill e l’elaborazione dei prompt sul rack Helios, compensando le minori efficienze del WSE in quella parte del flusso di lavoro, mentre il WSE si concentra sul decode e sulla generazione dei token.

Il confronto è stato effettuato su Kimi 2.6, un modello mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token. Il peso completo in INT4 è di circa 500 GB; un singolo wafer Cerebras contiene 44 GB. Pertanto, un’implementazione esclusivamente WSE richiederebbe oltre una dozzina di wafer, mentre un rack Helios può ospitare il modello molte volte, rendendo questo miglioramento particolarmente significativo per modelli che non possono risiedere interamente su pochi wafer WSE.

Nonostante i risultati promettenti, è necessario condurre ulteriori test comparativi, anche in relazione alle offerte rackscale di altri fornitori. Inoltre, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti. Questo sviluppo arriva in un momento in cui Nvidia ha recentemente concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’intensa competizione nel settore.

L’annuncio della partnership tra AMD e Cerebras si inserisce in un contesto di crescente attenzione da parte degli investitori e del mercato sul finanziamento circolare nel settore dell’intelligenza artificiale. Nel frattempo, Cerebras, che è stata quotata a maggio, ha visto oscillazioni significative del suo titolo, mentre AMD ha mantenuto rialzi rilevanti del valore azionario dall’inizio dell’anno.

In conclusione, la combinazione delle tecnologie di AMD e Cerebras potrebbe rappresentare un punto di svolta per l’inferenza AI, promettendo prestazioni superiori e una maggiore efficienza energetica. Resta da vedere come queste innovazioni influenzeranno il panorama competitivo e quali altre sorprese riserverà il futuro nel campo dell’intelligenza artificiale.

Autore

redazione

Analisi, dati e scenari per Dossier Economia.

Tutti gli articoli