AMD and Cerebras Announce Industry-Leading Ultra-Low-Latency and High Throughput AI Inference Solution
AMD と Cerebras は、AMD の Helios ラックスケールシステムと Cerebras の Wafer-Scale Engine を組み合わせた分離型 AI 推論ソリューションで技術提携すると発表した。両社によれば、この組み合わせにより1ワットあたりの毎秒トークン数を最大5倍に高められるという。ソリューションは2026年後半に Cerebras Cloud 経由で提供される予定だ。Cerebras は自社データセンターにも AMD Helios システムを導入する計画としている。
Cerebras Systems 公式IRニュースルームで全文を読む ↗