2026年7月24日,AMD在Advancing AI 2026活动上宣布携手Cerebras,共同开发面向超低延迟AI推理的联合解决方案。该方案整合AMD Helios机架级系统与Cerebras晶圆级引擎(WSE),分别承担大上下文处理与高带宽Token生成任务。此举旨在应对英伟达与Groq合作带来的竞争压力。双方预计,协同架构可将每瓦每秒Token数提升5倍。技术核心在于减少外部网络瓶颈,依托WSE单硅片集成数十万核心及GB级SRAM。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。

扫一扫关注微信