METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

OpenAI 推出 GPT-6.1 Sol Ultrafast

OpenAI 推出 GPT-6.1 Sol 的 Ultrafast 模式,并在 API、Codex 和 ChatGPT Work 中逐步上线。其速度最高比标准模式快 8 倍,API 单价为标准的 6 倍,并拥有比 Astra 更宽的使用限额和欧盟数据驻留。

OpenAI 推出 GPT-6.1 Sol Ultrafast

图片:@OpenAIDevs (X)(视频截图)

摘要

  • OpenAI 于 10 月 8 日推出 GPT-6.1 Sol 的 Ultrafast 模式,速度最高比 Sol 标准模式快 8 倍,并在 API、Codex 和 ChatGPT Work 中逐步上线。
  • API 价格为每百万输入 token 12 美元、每百万输出 token 60 美元,是标准单价的 6 倍;在 Codex 和 ChatGPT Work 中仅限 Pro 500 及部分 Enterprise、Edu 方案使用。
  • Sol Ultrafast 在 Grow 等级的每分钟 token 限额为 4000 万,是 Astra Ultrafast 的 8 倍,并同时支持美国和欧盟数据驻留。
Ultrafast is rolling out today for GPT-6.1 Sol in the API, Codex, and ChatGPT Work.

OpenAI 于当地时间 10 月 8 日推出 GPT-6.1 Sol 的 Ultrafast 模式。OpenAI 开发者账号当天在官方 X 上表示,Ultrafast 正在 API、Codex 和 ChatGPT Work 中逐步上线,速度最高比 Sol 标准模式快 8 倍。API 价格为每百万输入 token 12 美元、每百万输出 token 60 美元。9 月 29 日开发者大会上率先用于顶级模型 GPT-6 Astra 的速度等级,九天后下放到了低一级的模型。

METAL 曾报道 OpenAI 在开发者大会上推出速度等级 Ultrafast,当时公司预告 GPT-6.1 Sol 的 Ultrafast 即将推出。同日发布的 GPT-6.1 Sol 主打以更低的单价提供接近 Astra 的性能。METAL 也报道了 GPT-6.1 Sol 发布的消息。此次推出后,OpenAI 的 Ultrafast 阵容扩展为 Astra 和 Sol 两个模型。

OpenAI 开发者账号在发布帖中写道,Ultrafast "以比 Sol 标准模式最高快 8 倍的速度提供接近 Astra 的智能","让你以灵感涌现的速度进行构建"。在随后的价格帖中,它表示 Ultrafast 是为"速度和智能能带来差异的工作"而打造的。公司举出的例子是排查故障、在应用间操作的智能体,以及分秒必争的实时服务。

价格随速度上涨。根据 METAL 查阅的 OpenAI 价格对比表,GPT-6.1 Sol 的标准 API 单价为每百万输入 token 2 美元、输出 10 美元,快 2 倍的 Fast 模式为 4 美元和 20 美元。最高快 8 倍的 Ultrafast 正好是标准的 6 倍。同一张表中,GPT-6 Astra 的标准单价为输入 10 美元、输出 50 美元,因此 Sol Ultrafast 比 Astra 标准贵 1.2 倍。让较小的模型快速运行,比以标准速度使用更聪明的旗舰模型略贵。据报道,缓存输入为每百万 token 0.60 美元,缓存写入为 15 美元;输入超过 27.2 万 token 的长提示词适用不同单价,选择区域处理则另加 10%。

METAL 查阅的 OpenAI API 指南将 Ultrafast 定义为 API 中最快的服务等级,并写明"在速度值得更高成本时使用"。它已向 GPT-6 Astra 和 GPT-6.1 Sol 正式开放,GPT-5.6 Sol 则为预览。开发者只需将模型设为 gpt-6.1-sol,并把 service_tier 设为 ultrafast。Astra 和 Sol 的 Ultrafast 对所有 API 用户开放,并采用与标准和 Fast 模式分开的使用限额。

GPT-6.1 Sol의 Ultrafast·Fast·Standard와 GPT-6 Astra Standard의 입력·출력 단가와 속도 배수를 비교한 오픈AI 요금표

Sol 的限额宽裕得多。根据指南,GPT-6.1 Sol Ultrafast 的默认限额按每分钟 token 计,Build 等级为 100 万,Launch 为 400 万,Grow 为 4000 万。同等级下 Astra Ultrafast 仅为 50 万、100 万和 500 万,等级越高差距越大,分别为 2 倍、4 倍和 8 倍。数据处理位置也不同:Sol Ultrafast 同时支持美国和欧盟数据驻留及全球处理,而 Astra Ultrafast 仅支持美国驻留和全球处理。

OpenAI 强烈建议工具调用频繁的智能体使用保持连接的 WebSocket,因为每次请求都重新连接会让网络延迟抵消速度优势。指南附有示例代码,演示如何在同一 WebSocket 连接中传递上一个响应的 ID,串联多轮对话。

Codex 和 ChatGPT Work 的门槛较高。据报道,Sol Ultrafast 在这两款产品中仅向 Pro 500 方案、符合条件的按用量计费 Enterprise 方案以及按额度计费的 Edu 方案开放,Enterprise 需由管理员自行启用。Pro 500 于 9 月 29 日开发者大会上与 Astra Ultrafast 一同推出,是个人用户在这两款产品中使用 Ultrafast 的唯一途径。

METAL 查看的 14 秒发布视频没有声音。黑色画面上,一句介绍标准模式 GPT-6.1 Sol 的英文句子用将近 2 秒逐字打出后消失。随后,以 Ultrafast 模式结尾的同一句子在不到 0.5 秒内整句出现。视频以邀请观众今天就在 Codex、ChatGPT Work 和 API 中试用的句子结束。附带视频的发布帖在发出不到两小时内获得 32 万次浏览和 2800 多个点赞。

从工程师的角度看,此次发布的核心与其说是速度,不如说是限额和处理位置。Astra Ultrafast 高等级限额偏低且不支持欧盟数据驻留,是大规模运营的障碍。Sol Ultrafast 拥有最高 8 倍的限额和欧盟驻留,具备承接真实服务流量的配置。剩下的计算是找出哪些调用的响应延迟足以左右用户体验,值得承担 6 倍的单价。

评论