数码硬件
morning
30倍速度碾压英伟达GPU!Cerebras发布CS-4加速器:4万亿晶体管+90万核心
摘要
快科技8月20日消息, AI芯片公司Cerebras Systems当地时间8月18日正式推出新一代机架级AI系统CS-4,宣称其为“业界最快的AI加速器”,推理速度最高可达GPU方案的30倍。 该加速器由三颗全新的WSE-3 Turbo晶圆级处理器驱动, 每颗集成4万亿晶体管和90万个AI优化核心, 覆盖46225平方毫米硅面积。 CS-4是Cerebras新一代Nexus机架级平台架构的首款产...
快科技8月20日消息
AI芯片公司Cerebras
Systems当地时间8月18日正式推出新一代机架级AI系统CS
宣称其为
业界最快的AI加速器
推理速度最高可达GPU方案的30倍
该加速器由三颗全新的WSE
Turbo晶圆级处理器驱动
每颗集成4万亿晶体管和90万个AI优化核心
覆盖46225平方毫米硅面积
2026-08-20
1 阅读
约2分钟阅读
红茶
字号:
快科技8月20日消息, AI芯片公司Cerebras Systems当地时间8月18日正式推出新一代机架级AI系统CS-4,宣称其为“业界最快的AI加速器”,推理速度最高可达GPU方案的30倍。 该加速器由三颗全新的WSE-3 Turbo晶圆级处理器驱动, 每颗集成4万亿晶体管和90万个AI优化核心, 覆盖46225平方毫米硅面积。 CS-4是Cerebras新一代Nexus机架级平台架构的首款产品。采用模块化设计将计算、供电和I/O分离为独立元件,零件数量较上一代减少50%。 该产品的电源转换模块从传统GPU主板上距处理器约50毫米的位置缩短至约0.5毫米。可插拔的背包式设计将电源转换、液冷和控制电子集成一体,部署时间从数天缩短至数小时。 性能表现上,CS-4提供750 PFLOPs的AI算力、每秒129.6 PB的内存带宽以及每秒7.2 Tbps的I/O吞吐量。与前代CS-3相比速度提升两倍,每瓦吞吐量提升10倍。 在GPT-OSS-120B模型测试中, CS-4每用户每秒可生成超过4400个Token,最高达到GPU方案的30倍, 晶圆间延迟从约5微秒降至2微秒。 CS-4采用台积电5纳米制程及系统级晶圆(SoW)封装打造,最大特点是无需高带宽存储器,以SRAM取代。单个机柜可容纳3颗晶圆。系统支持超过50万亿参数的模型,TDP约125至135kW。 预计2026年第三季度开始出货。Cerebras同时与亚马逊AWS和AMD合作,允许客户将计算密集度极高的预填充阶段外包给AMD Instinct GPU。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱