METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

OpenAI 推出速度等级 Ultrafast

OpenAI 在 DevDay 2026 上推出 Ultrafast,以每秒最高 300 个 token 的速度运行 GPT-6 Astra。API 价格为标准价格的 6 倍,在 ChatGPT Work 和 Codex 中仅面向新套餐 Pro 500 和 Enterprise 提供。

OpenAI 推出速度等级 Ultrafast

图片:@OpenAI (X)(视频截图)

摘要

  • OpenAI 于 9 月 29 日在 DevDay 2026 上推出高级速度等级 Ultrafast,每秒最高输出 300 个 token,在 Codex 中最快提升 8 倍,在 API 中最快提升 6 倍。
  • 首个支持的模型是 GPT-6 Astra,API 价格为标准价格的 6 倍,在 ChatGPT Work 和 Codex 中可通过提供 Plus 25 倍用量的新套餐 Pro 500 以及 Enterprise 使用。
  • 它比 8 月预览版的每秒 750 个 token 慢,但把速度加在了最高端模型上,GPT-6.1 Sol 版 Ultrafast 也即将推出。
This is Ultrafast. Our premium speed tier, Ultrafast offers up to 8x faster token generation (300 tokens per second) in Codex and up to 6x in the API.

OpenAI 在 9 月 29 日于旧金山举办的 DevDay 2026 上推出了高级速度等级 Ultrafast。OpenAI 在官方 X 账号上表示,Ultrafast 在编程工具 Codex 中将 token 生成速度最高提升 8 倍,在 API 中最高提升 6 倍,每秒最高可输出 300 个 token。首个支持的模型是其最高端模型 GPT-6 Astra,当天起即可在 API、ChatGPT Work 和 Codex 中使用。GPT-6.1 Sol 版 Ultrafast 即将推出。

速度并不免费。据报道,在 API 中使用 Ultrafast 需支付同一模型标准价格的 6 倍。OpenAI 现有的 Fast 模式价格为标准的 2 倍,以 Astra 为例速度约快 2.5 倍。Ultrafast 的价格又比 Fast 模式高出 3 倍。OpenAI Developers 账号写道,在 Codex 中 Ultrafast "比 Astra 标准版最快 8 倍,比 Astra Fast 快 4 倍",并称"以打字的速度把想法变成现实"。

要在 ChatGPT Work 和 Codex 中使用 Ultrafast,需要新的套餐。OpenAI 当天推出 Pro 500,将相当于 ChatGPT Plus 25 倍的最高用量与 Ultrafast 使用权捆绑在一起。企业客户通过 Enterprise 套餐使用。据报道,现有 Pro 套餐在 ChatGPT Work 和 Codex 中的用量从 Plus 的 20 倍降至 10 倍,聊天中的 GPT-6 Pro 消息也从每周 200 条减半至 100 条。现有订阅用户在过渡期内保留当前额度,并获得一次性额度补偿。

Metal 查看的 45 秒发布视频是一场两个等级并排制作同一 3D 场景的比赛。左侧 Standard 画面和右侧 Ultrafast 画面中,圆形工作台上的两只机械臂同时开始组装火箭。Ultrafast 一侧在 6.4 秒内装好箭体和尾翼,切换到发射台场景并把火箭送上天空。Standard 一侧在同一时刻仍停留在空工作台,直到 30.3 秒才完成组装并移到发射台。截至 9 月 30 日,附带该视频的首条帖子浏览量约为 87.8 万次。

面向开发者的条件写在 OpenAI 的 API 指南中。只需在请求中把 service_tier 设为 ultrafast。GPT-6 Astra 已向所有 API 用户开放,但初始速率限制较低。默认限制为使用等级 1 至 3 每分钟 50 万 token,等级 4 为 100 万,等级 5 为 500 万。OpenAI 强烈建议工具调用频繁的智能体使用保持连接的 WebSocket,因为每次请求重新建立连接会让网络延迟抵消速度优势。Ultrafast 仅支持美国数据驻留和全球处理,不支持欧盟及其他区域处理端点。

오픈AI Ultrafast 발표 영상 장면. 같은 로켓 3D 장면을 만드는 경주에서 오른쪽 Ultrafast는 6.4초에 조립을 끝내고 로켓을 띄웠고, 왼쪽 Standard는 29.5초에도 로봇 팔이 조립 중이다

这一等级在一个半月前就有预告。Metal 曾报道,OpenAI 于 8 月 13 日预告了将 GPT-5.6 Sol 提速最高 14 倍的超高速模式。当时 OpenAI 借助 Cerebras 硬件实现了每秒最高 750 个 token,并仅向 Jane Street、Podium、Basis、Rogo 等部分客户有限开放。Jane Street AI 助手负责人 John Crepezzi 当时表示,"Cerebras 带来的速度提升令人印象深刻",并称"它让模型有了不同的使用方式,也让开发者能够与模型并肩、更专注高效地工作"。API 指南中至今仍将 GPT-5.6 Sol 列为预览对象。

这次发布在绝对速度上退了一步,却在模型上进了一步。每秒 300 个 token 慢于 8 月预览的 750 个,但这一速度加在了 OpenAI 最高端的模型上。据报道,基准测试公司 Artificial Analysis 测得的输出速度为:Google 的 Gemini 3.5 Flash 约每秒 201 个 token,速度专用模型 Mercury 2 约 769 个,Celeris-1 约 1,491 个。OpenAI 此前在 Cerebras 上跑出每秒 1,000 多个 token 的 GPT-5.3-Codex-Spark,也是一款基准分数较低的小模型。据报道,Ultrafast 的不同之处不在于绝对速度,而在于在 GPT-6 级最高端模型上实现这一速度。

Ultrafast 是 DevDay 上 20 多项发布之一。Metal 也报道了同一活动中发布的 GPT-6.1 Sol 和常驻智能体 dots。把这些发布放在一起看,OpenAI 的布局就清楚了。GPT-6.1 Sol 以 Astra 标准价格的五分之一提供接近 Astra 的性能,让重复性工作变便宜;Ultrafast 则反其道而行,对人在屏幕前等待的时刻收取 6 倍价格。OpenAI 在 8 月的公告中列举了故障响应、金融研究、客户支持和电商等用例,并写道"当速度不再需要以牺牲智能为代价时,AI 就能进入企业中对时间最敏感的环节"。

从记者的角度看,这次发布中被重新定价的不是模型,而是等待。即使同一个 GPT-6 Astra 给出同样的答案,耗时 30 秒的答案和耗时 6 秒的答案如今价格不同。个人开发者要买下这段差距就得升级到 Pro 500,而现有 Pro 用户的额度减半。随着速度成为一种产品,OpenAI 的价格表在智能和成本之外多了第三个维度:时间。

评论