郭震 AI公众号:郭震AI

实时 AI 消息

英伟达:OpenAI GPT-6 Astra Ultrafast 跑在 Blackwell 上,token 生成快至 8 倍

英伟达在官方博客中称,OpenAI 的 GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,现已通过 OpenAI API 以及面向符合条件的 ChatGPT Work 和 Codex 用户开放。该模式号称 token 生成速度最高可达 Astra Standard 的 8 倍,英伟达将这一提升归功于模型侧的推理优化对 Blackwell 架构能力的调用。

发布时间
英伟达:OpenAI GPT-6 Astra Ultrafast 跑在 Blackwell 上,token 生成快至 8 倍
图源: blogs.nvidia.com

英伟达(NVIDIA)在官方博客中表示,OpenAI 的 GPT-6 Astra Ultrafast 运行在 NVIDIA Blackwell GPU 上,现已通过 OpenAI API,以及面向符合条件的 ChatGPT Work 和 Codex 用户开放。

英伟达给出的核心卖点是速度:Ultrafast 的 token 生成速度最高可达 Astra Standard 模式的 8 倍。英伟达把这一提升归因于 OpenAI 模型内部的推理优化,这些优化充分调用了 NVIDIA Blackwell 架构的能力。

这一组合的意义在于,它把 OpenAI 最快的服务档位直接绑定到英伟达当前一代数据中心 GPU 上。英伟达没有把 GPU 当作通用基础设施,而是把 Blackwell 描述为提速得以实现的根本原因。

对开发者而言,通过 OpenAI API 上线才是最实际的部分:更快的模式是一个可以切换的选项,面向已经建立在 OpenAI 平台上的应用,同时覆盖符合条件的 ChatGPT Work 与 Codex 账号。

真正的信号在于推理经济学。随着前沿模型的推理成本不断攀升,单 token 延迟与吞吐量正在成为产品特性,硬件厂商也越来越把自己定位为模型响应速度背后的原因。

接下来值得关注的是:8 倍的数字在独立测试和真实负载下能否站得住脚,Ultrafast 是否会成为 API 客户的默认档位,以及在其他加速器厂商的竞争下,OpenAI 公开把最快模式绑定到 Blackwell 会带来怎样的回应。

为什么重要

这说明 OpenAI 最快档位的性能已经与英伟达最新一代 GPU 深度绑定,推理速度正在成为模型产品竞争的核心指标,其他加速器厂商如何应对值得持续关注。

微博邮件

OpenAINVIDIA
返回实时消息

附近消息

全部