3 Tačke
Članak

AMD i Cerebras udružuju snage za AI inferencu niske latencije

AMD i Cerebras razvijaju platformu koja kombinuje EPYC procesore i Instinct GPU sa WSE rešenjima za bržu i efikasniju AI inferencu, uz najavu dostupnosti kroz Cerebras Cloud u drugoj polovini 2026.

3 Tačke
46 sekundi čitanja

AMD i Cerebras Systems najavili su razvoj platforme koja kombinuje AMD-ove EPYC procesore u Helios rack infrastrukturi sa Cerebras-ovim Wafer-Scale Engine (WSE) rešenjima. Cilj je postizanje niske latencije i visoke propusnosti za AI inferencu, pri čemu AMD Helios sa Instinct GPU obrađuje promptove i velike kontekstne prozore, dok Cerebras WSE preuzima generisanje tokena osetljivo na kašnjenje.

Očekuje se da će nova platforma isporučiti do 5 puta više tokena po sekundi po vatu (T/s/W) u odnosu na postojeća rešenja. Princip je sličan Nvidijinom CPX konceptu, ali sa obrnutom specijalizacijom. Cerebras planira da instalira AMD Helios sisteme u svoje data centre i integriše ih sa WSE rekovima, a kombinovana ponuda biće dostupna kroz Cerebras Cloud u drugoj polovini 2026. godine.

Povezani članci