OpenAI-forskare lovordar AMD:s AI-lösning
OpenAI-forskaren Jeffrey Wang beskriver AMD:s och Cerebrasi:s gemensamma AI-lösning för inferens som "otrolig". Lösningen syftar till extremt låg latens i AI-uppgifter.

OpenAI-forskaren Jeffrey Wang har gett starka lovord till den nya AI-lösning för inferens som utvecklats genom ett samarbete mellan AMD och Cerebras. Lösningen kombinerar AMD:s Helios-racklösning med Cerebrasi:s chip-teknik för att möta konkurrensen, särskilt inom applikationer som kräver mycket låg latens.
Helios-systemet är utformat för att hantera hög prestanda och skalbar genomströmning, särskilt för prompt-bearbetning och stora kontexter i AI-modeller. Cerebrasi:s Wafer-Scale Engine fokuserar på token-generering och avkodning, där minnesbandbredd och låg latens är kritiskt. I kombination kan systemet femdubbla mängden tokens som genereras per watt och sekund, vilket är en betydande effektivitetsförbättring.
Enligt Wang har lösningen visat "otroliga" resultat internt hos OpenAI när de kört vissa modeller på Cerebrasi-chip. Han beskriver hur uppgifter som tidigare tog minuter nu slutförs "omedelbart", vilket drastiskt ökar arbetseffektiviteten. Detta är särskilt viktigt för arbetsflöden där snabba svarstider är avgörande.
Samarbetet mellan AMD och Cerebras är ett svar på den ökande efterfrågan på effektiva och snabba AI-inferenslösningar. I takt med att AI-modeller blir allt större och mer komplexa, blir behovet av optimerade hårdvarulösningar allt viktigare för att kunna driva dessa system på ett kostnadseffektivt sätt.
Marknaden har reagerat positivt på samarbetet, vilket bland annat visades av en tidigare kursuppgång för Cerebras. Partnerskapet förväntas stärka AMD:s position på den växande marknaden för AI-hårdvara, då fler företag söker sig till liknande lösningar för sina AI-initiativ.