In Breve
- Qual è l'obiettivo della partnership tra AMD e Cerebras?
- Sviluppare una soluzione disaggregata per l'inferenza AI combinando Helios e Wafer-Scale Engine.
- Quando sarà disponibile la nuova soluzione?
- Nella seconda metà del 2026 tramite Cerebras Cloud.
- Quali sono i vantaggi della nuova architettura?
- Incremento fino a cinque volte dei token per secondo per watt rispetto a una configurazione WSE standalone.
In un annuncio che potrebbe segnare un’importante svolta nel campo dell’intelligenza artificiale, AMD e Cerebras Systems hanno ufficializzato una partnership tecnica per sviluppare una soluzione disaggregata per l’inferenza AI. Questa innovativa integrazione combina il rackscale Helios di AMD con il Wafer-Scale Engine (WSE) di Cerebras, con disponibilità prevista attraverso il Cerebras Cloud nella seconda metà del 2026.
Secondo i test interni condotti dalle due aziende, la nuova architettura promette un incremento fino a cinque volte dei token per secondo per watt (TPS/W) rispetto a una configurazione WSE standalone. Questo miglioramento è stato misurato utilizzando l’open-source Kimi 2.6 1T, un modello di mixture-of-experts con un trilione di parametri totali, ma solo circa 32 miliardi attivi per token.
La soluzione proposta prevede uno spostamento della fase di prefill e dell’elaborazione dei prompt sul rack Helios, compensando così le minori efficienze del WSE in questa fase del flusso di lavoro. Il WSE, a sua volta, si concentrerà sul decode e sulla generazione dei token, ottimizzando l’intero processo di inferenza.
Un aspetto interessante di questa collaborazione è la gestione dei dati. Un singolo wafer Cerebras ha una capacità di 44 GB, il che significa che un’implementazione esclusivamente basata su WSE richiederebbe oltre una dozzina di wafer. In contrasto, un rack Helios può ospitare il modello molte volte, rendendo questa soluzione particolarmente vantaggiosa per modelli che non possono risiedere interamente su pochi wafer WSE.
Tuttavia, è importante notare che ulteriori test comparativi saranno necessari, specialmente rispetto alle offerte rackscale di altri fornitori. Al momento, i termini finanziari dell’accordo tra AMD e Cerebras non sono stati resi noti.
Questo annuncio arriva in un contesto di crescente attenzione da parte degli investitori e del mercato nei confronti del finanziamento circolare nel settore dell’intelligenza artificiale. Recentemente, Nvidia ha concordato una licenza non esclusiva per la tecnologia di SRAM decode di Groq, valutata 20 miliardi di dollari, evidenziando l’importanza strategica di queste tecnologie nel panorama competitivo attuale.
Inoltre, Cerebras, che è stata quotata in borsa a maggio, ha registrato oscillazioni significative del suo titolo, mentre AMD continua a mantenere un rialzo rilevante del valore azionario year-to-date. Con questa nuova partnership, entrambe le aziende puntano a posizionarsi come leader nel settore dell’inferenza AI, un campo in rapida evoluzione e sempre più cruciale per il futuro della tecnologia.
