GPT-6 Astra Ultrafast 于 2026 年 10 月 1 日登场:NVIDIA 官方博客发文《How NVIDIA GPUs Help Accelerate OpenAI's GPT-6 Astra Ultrafast》,宣布这款跑在 Blackwell GPU 上的新版本即日起经 OpenAI API 向开发者开放,ChatGPT Work 与 Codex 的符合条件用户同步可用。与标准版 Astra 相比,Ultrafast 的 token 生成速度最高可达 8 倍——编程循环更快,工具调用更顺,交互式应用响应更跟手。
Ultrafast 是什么
Ultrafast 不是全新模型,而是 GPT-6 Astra 专为 Blackwell 打造的高速版本:不用学新架构、换新接口,同一个 Astra 直接提速。
8 倍速度从哪来
这 8 倍来自 OpenAI 推理优化与 Blackwell 架构能力的叠加,而非单纯堆硬件。OpenAI 推理负责人 Philippe Tillet 指出,NVIDIA 在工具链和文档上的深度投入,让 OpenAI 的模型擅长为 Blackwell 与未来的 Rubin GPU 编写高性能 kernel,Astra Ultrafast 正是把这种加速变成了智能体写代码、调工具时的更快响应。OpenAI 计算 CTO Uday Ruddarraju 则表示,团队持续用自家模型优化 NVIDIA GPU 上的推理软件,平台的可编程性正是这次提速的关键。
谁最先吃到红利
速度提升最先落到三类场景:编程智能体的“写代码—跑测试—修 bug”循环每一步都在等模型生成,8 倍速度让循环更快;工具调用密集的任务里,调用间隔的等待更短,“思考—行动—再思考”的节奏更顺;对话、代码补全这类延迟敏感的应用,响应明显更跟手。
对开发者意味着什么
值得注意的是,这次提速不止于“发布那一刻的加速”:OpenAI 仍在用自家模型打磨 NVIDIA GPU 上的推理软件,可编程平台让同一套基础设施在训练、推理与强化学习之间复用、提高利用率——Ultrafast 的速度优势很可能随软件迭代继续放大。想尝鲜的开发者可查阅 OpenAI 开发者文档中的 Ultrafast 指南,接入、定价与实现细节列在其中。