Nvidia paid $20 billion for SRAM decode - AMD just partnered for it instead
AMD and Cerebras will split inference across two machines, with Helios racks handling prompt processing and the Wafer-Scale Engine generating tokens, available through Cerebras Cloud in H2 2026Nvidia is also doing…
Read on TechRadar ↗