
图片:@OpenAI (X)(视频截图)
摘要
- OpenAI 于 9 月 29 日在 DevDay 2026 上推出高级速度等级 Ultrafast,每秒最高输出 300 个 token,在 Codex 中最快提升 8 倍,在 API 中最快提升 6 倍。
- 首个支持的模型是 GPT-6 Astra,API 价格为标准价格的 6 倍,在 ChatGPT Work 和 Codex 中可通过提供 Plus 25 倍用量的新套餐 Pro 500 以及 Enterprise 使用。
- 它比 8 月预览版的每秒 750 个 token 慢,但把速度加在了最高端模型上,GPT-6.1 Sol 版 Ultrafast 也即将推出。
OpenAI 在 9 月 29 日于旧金山举办的 DevDay 2026 上推出了高级速度等级 Ultrafast。OpenAI 在官方 X 账号上表示,Ultrafast 在编程工具 Codex 中将 token 生成速度最高提升 8 倍,在 API 中最高提升 6 倍,每秒最高可输出 300 个 token。首个支持的模型是其最高端模型 GPT-6 Astra,当天起即可在 API、ChatGPT Work 和 Codex 中使用。GPT-6.1 Sol 版 Ultrafast 即将推出。
速度并不免费。据报道,在 API 中使用 Ultrafast 需支付同一模型标准价格的 6 倍。OpenAI 现有的 Fast 模式价格为标准的 2 倍,以 Astra 为例速度约快 2.5 倍。Ultrafast 的价格又比 Fast 模式高出 3 倍。OpenAI Developers 账号写道,在 Codex 中 Ultrafast "比 Astra 标准版最快 8 倍,比 Astra Fast 快 4 倍",并称"以打字的速度把想法变成现实"。
要在 ChatGPT Work 和 Codex 中使用 Ultrafast,需要新的套餐。OpenAI 当天推出 Pro 500,将相当于 ChatGPT Plus 25 倍的最高用量与 Ultrafast 使用权捆绑在一起。企业客户通过 Enterprise 套餐使用。据报道,现有 Pro 套餐在 ChatGPT Work 和 Codex 中的用量从 Plus 的 20 倍降至 10 倍,聊天中的 GPT-6 Pro 消息也从每周 200 条减半至 100 条。现有订阅用户在过渡期内保留当前额度,并获得一次性额度补偿。
Metal 查看的 45 秒发布视频是一场两个等级并排制作同一 3D 场景的比赛。左侧 Standard 画面和右侧 Ultrafast 画面中,圆形工作台上的两只机械臂同时开始组装火箭。Ultrafast 一侧在 6.4 秒内装好箭体和尾翼,切换到发射台场景并把火箭送上天空。Standard 一侧在同一时刻仍停留在空工作台,直到 30.3 秒才完成组装并移到发射台。截至 9 月 30 日,附带该视频的首条帖子浏览量约为 87.8 万次。
面向开发者的条件写在 OpenAI 的 API 指南中。只需在请求中把 service_tier 设为 ultrafast。GPT-6 Astra 已向所有 API 用户开放,但初始速率限制较低。默认限制为使用等级 1 至 3 每分钟 50 万 token,等级 4 为 100 万,等级 5 为 500 万。OpenAI 强烈建议工具调用频繁的智能体使用保持连接的 WebSocket,因为每次请求重新建立连接会让网络延迟抵消速度优势。Ultrafast 仅支持美国数据驻留和全球处理,不支持欧盟及其他区域处理端点。

这一等级在一个半月前就有预告。Metal 曾报道,OpenAI 于 8 月 13 日预告了将 GPT-5.6 Sol 提速最高 14 倍的超高速模式。当时 OpenAI 借助 Cerebras 硬件实现了每秒最高 750 个 token,并仅向 Jane Street、Podium、Basis、Rogo 等部分客户有限开放。Jane Street AI 助手负责人 John Crepezzi 当时表示,"Cerebras 带来的速度提升令人印象深刻",并称"它让模型有了不同的使用方式,也让开发者能够与模型并肩、更专注高效地工作"。API 指南中至今仍将 GPT-5.6 Sol 列为预览对象。
这次发布在绝对速度上退了一步,却在模型上进了一步。每秒 300 个 token 慢于 8 月预览的 750 个,但这一速度加在了 OpenAI 最高端的模型上。据报道,基准测试公司 Artificial Analysis 测得的输出速度为:Google 的 Gemini 3.5 Flash 约每秒 201 个 token,速度专用模型 Mercury 2 约 769 个,Celeris-1 约 1,491 个。OpenAI 此前在 Cerebras 上跑出每秒 1,000 多个 token 的 GPT-5.3-Codex-Spark,也是一款基准分数较低的小模型。据报道,Ultrafast 的不同之处不在于绝对速度,而在于在 GPT-6 级最高端模型上实现这一速度。
Ultrafast 是 DevDay 上 20 多项发布之一。Metal 也报道了同一活动中发布的 GPT-6.1 Sol 和常驻智能体 dots。把这些发布放在一起看,OpenAI 的布局就清楚了。GPT-6.1 Sol 以 Astra 标准价格的五分之一提供接近 Astra 的性能,让重复性工作变便宜;Ultrafast 则反其道而行,对人在屏幕前等待的时刻收取 6 倍价格。OpenAI 在 8 月的公告中列举了故障响应、金融研究、客户支持和电商等用例,并写道"当速度不再需要以牺牲智能为代价时,AI 就能进入企业中对时间最敏感的环节"。
从记者的角度看,这次发布中被重新定价的不是模型,而是等待。即使同一个 GPT-6 Astra 给出同样的答案,耗时 30 秒的答案和耗时 6 秒的答案如今价格不同。个人开发者要买下这段差距就得升级到 Pro 500,而现有 Pro 用户的额度减半。随着速度成为一种产品,OpenAI 的价格表在智能和成本之外多了第三个维度:时间。
信息来源
- OpenAI (X) — This is Ultrafast. Our premium speed tier, Ultrafast offers up to 8x faster token generation (300 tokens per second) in Codex and up to 6x in the API. →
- OpenAI (X) — Ultrafast is available today for GPT-6 Astra in Codex, ChatGPT Work, and the API, with GPT-6.1 Sol coming soon. →
- OpenAI Developers (X) — Ultrafast is our fastest way to build with Astra yet →
- OpenAI — DevDay 2026 Recap →
- OpenAI Developers — Ultrafast mode | OpenAI API →
- OpenAI — Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed →
- VentureBeat — OpenAI's GPT-6.1 Sol offers Astra-like performance at 1/5th price. A new Ultrafast tier clocks at 300 tokens per second. →
- The Decoder — OpenAI expands Codex and its API at DevDay with security scans, a Decisions API, and Ultrafast →





评论