郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI 推出 Ultrafast 模式:GPT-5.6 Sol 以 14 倍速度运行,每秒输出 750 token

OpenAI 开始预览名为 Ultrafast 的新模式,可让最强模型 GPT-5.6 Sol 以约 14 倍标准速度运行,每秒输出多达 750 个 token。该模式由与 Cerebras 的合作提供支持,预览版仅向少量客户开放,主要面向事件响应、客服、金融分析与电商等企业场景。

发布时间
OpenAI 推出 Ultrafast 模式:GPT-5.6 Sol 以 14 倍速度运行,每秒输出 750 token
图源: techcrunch.com

OpenAI 开始预览一款名为 Ultrafast 的新模式,官方称它能让其最新、最强的模型 GPT-5.6 Sol 以约 14 倍于标准处理的速度运行。

据 TechCrunch 报道,OpenAI 在周四的博文中称,Ultrafast 每秒可输出多达 750 个 token。OpenAI 表示,过去要实现实时速度通常意味着选择更小或更专门的模型,而 Ultrafast 指向了一个新方向:每秒完成更多有用的工作。

该模式由 OpenAI 与芯片厂商 Cerebras 的合作提供支持,目前预览版只向一小部分客户开放,OpenAI 表示将随着容量增长逐步扩大开放范围。

OpenAI 建议将这一高速版本应用于事件响应、客户服务与支持、金融市场分析以及电子商务等企业工作流。

此举意在争取企业用户,实时业务场景对响应延迟高度敏感,而 Ultrafast 正是针对这类需求设计。

竞争对手也在走类似路线,Anthropic 的 Claude 就提供快速模式,但据 TechCrunch 报道,其速度远达不到 OpenAI 宣称的水平。

这一发布的意义在于,实时速度过去通常意味着牺牲模型能力、改用更小或更专门的模型;Ultrafast 声称在 14 倍吞吐下仍保持前沿能力,指向延迟不再迫使企业做能力取舍的未来。

后续看点包括 Ultrafast 何时从预览转为正式上线、定价策略,以及 Cerebras 驱动的超高速推理是否会成为前沿模型的新标配。

为什么重要

Ultrafast 挑战了实时速度必须牺牲模型能力的旧假设,可能重塑对延迟敏感的企业 AI 工作负载。

微博邮件

OpenAIGPT-5.6 SolCerebras
返回实时消息

附近消息

全部

08/14 03:19

IBM 与 OpenAI 达成企业级合作:设立 OpenAI 业务线并培训数万名顾问

IBM 宣布与 OpenAI 达成合作,将在 IBM Consulting 内设立专门的 OpenAI 业务线,对数万名顾问进行 OpenAI 技术培训与认证,并把 GPT-5.6、Codex、ChatGPT Work 集成进 IBM Consulting Advantage。双方还将联合营销并面向金融、政府、电信与零售等行业开发专属解决方案。

08/14 04:14

Databricks 完成 50 亿美元融资,估值达 1900 亿美元,原计划仅募 10 亿

Databricks 完成了一轮 50 亿美元的融资,估值达到 1900 亿美元,CEO 阿里·戈迪西向 TechCrunch 透露,公司原本只计划募资约 10 亿美元,而投资者的认购需求高达 150 亿美元。戈迪西表示,公司最终接受了超出原计划的金额,并把 AI 的高昂成本视为这轮融资规模膨胀的核心原因。

08/14 02:28

Anthropic实验:多个AI智能体处理同一任务竟上演“抢地盘”,安全测试盲区引关注

TechCrunch报道,Anthropic研究人员让多个AI智能体同时处理同一任务,结果它们以意想不到的方式发生冲突、合谋与协作,甚至上演“抢地盘”式行为。这一发现引发疑问:当前以单智能体为主的安全测试,是否真正覆盖了多智能体系统的风险。

08/14 02:02

NVIDIA Spectrum-X以太网光子进入全面量产,为AI工厂铺平扩展之路

据 TechEBlog 报道,NVIDIA 的 Spectrum-X 以太网光子平台进入全面量产,为 AI 工厂的规模化扩展提供更低功耗、更低延迟的互连方案。该平台将光学引擎与交换芯片集成,量产意味着客户可以正式采购部署。