郭震 AI公众号:郭震AI

实时 AI 消息

Cerebras发布CS-4服务器系统,称AI聊天推理速度比英伟达GPU快30倍

Cerebras发布新一代CS-4服务器系统,声称在AI聊天机器人推理场景下速度可达英伟达GPU的30倍。该发布延续了Cerebras以晶圆级芯片挑战英伟达AI推理市场地位的战略。

发布时间
Cerebras发布CS-4服务器系统,称AI聊天推理速度比英伟达GPU快30倍
图源: cerebras.ai

Cerebras正式发布CS-4服务器系统,宣称其在AI聊天机器人推理场景下的速度可达英伟达GPU的30倍。

据相关报道,CS-4延续了Cerebras基于晶圆级芯片的路线,聚焦大模型推理这一AI应用落地最密集的环节。

30倍的速度对比如果得到验证,将直接影响聊天机器人等实时交互应用的响应体验与推理成本。

Cerebras近年来一直以更快的速度和更低的成本切入AI推理市场,与英伟达形成正面竞争。

不过,这类性能数据通常来自特定基准与配置,实际部署中的收益还取决于工作负载类型与软件生态的成熟度。

值得关注的是CS-4的具体规格、价格与首批客户,以及英伟达是否会以新一代GPU和推理优化软件作出回应。

对行业而言,推理环节出现更多选择,有助于降低大模型应用的整体算力成本。

为什么重要

CS-4的发布表明AI推理芯片竞争正在加剧,若30倍性能优势得到验证,可能改变大模型应用对英伟达算力的依赖格局。

微博邮件

CerebrasAI ChipsInference
返回实时消息

附近消息

全部