METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

OpenAI 在 Codex 故障后重置使用额度

Codex 网页版、API、CLI 和 VS Code 扩展同时停摆,属于全面故障。恢复 13 分钟后,OpenAI 为所有付费用户恢复了使用额度,但故障原因尚未公开。

OpenAI 在 Codex 故障后重置使用额度

图片:METAL

摘要

  • 据 OpenAI 状态页面显示,Codex 于 9 月 25 日(UTC)22:58 至 23:54 发生了持续 56 分钟的全面故障。
  • 使用 ChatGPT 账户登录的用户仍收到 401 认证错误,OpenAI 建议以 API 密钥登录作为临时绕行方案。
  • 负责 Codex 的 Tibo 表示将为 Codex 和 ChatGPT Work 的所有付费用户重置使用额度,但根本原因尚未公开。

OpenAI 的编程智能体 Codex 于 9 月 25 日(UTC)停摆了 56 分钟。OpenAI 状态页面在 22:58 首次通报故障,并在 23:54 表示所有受影响的服务均已恢复。恢复后不久,负责 Codex 的 Tibo 在 X 上表示,将为 Codex 和 ChatGPT Work 的所有付费用户重置使用额度。

这次故障的等级最高。状态页面将此次事件归类为全面故障,而非部分故障。据报道,受影响的组件包括 Codex 网页版、Codex API、命令行工具(CLI)和 VS Code 扩展,用户无法通过任何途径使用 Codex。事发时正值加利福尼亚周五下午 3 点 58 分,伦敦则接近午夜。

恢复过程在状态页面上留下了六次更新。22:58,OpenAI 写道用户正在遭遇 Codex 故障,已找到内部问题并正在推进缓解措施。23:03 确认错误增多,23:19 给出绕行方案:"目前通过 API 密钥登录可以恢复访问。"23:34 宣布已找到根本原因,23:45 实施缓解措施并监控恢复情况,23:54 宣布恢复。从找到原因到恢复用了 20 分钟。

用户端出现的是认证错误。OpenAI 开发者论坛上的一篇帖子显示,一名使用 ChatGPT 账户登录的用户,其 Codex 界面和 CLI 都返回了 "401 Unauthorized: Incorrect API key provided" 错误。发帖人表示自己并未输入任何 API 密钥,更新 macOS 版 ChatGPT 应用、重启 Mac、重新生成认证文件、切换网络后仍是同样的错误。CLI 版本为 0.158.0-alpha.2,WebSocket 连接失败后改用 HTTPS 也返回同样的 401。据报道,网页版的 Codex 对话因消息流错误而中断,普通 ChatGPT 聊天却仍在正常回复;Codex 的 GitHub 仓库中出现了报告全面中断的 48234 号问题,随后作为 48237 号的重复项被关闭。

故障原因至今未公开。状态页面只写明 23:34 找到了根本原因,并未说明具体内容。有报道根据集中出现的认证错误和 API 密钥登录绕行方案,推测问题出在客户端与服务之间的认证环节,但 OpenAI 并未证实。

补偿在恢复 13 分钟后到来。Tibo 在故障期间发了一条简短的感叹,并于 9 月 26 日 00:07(UTC)引用该帖写道:"我们回来了,将为 Codex 和 ChatGPT Work 的所有付费用户重置使用额度。"他随后致歉称"对短暂的中断表示抱歉",并在括号中补充:"是的,服务停摆时我们有一个特别的备用 Codex 来帮忙。"这条帖子的浏览量超过 250 万次。

重置使用额度已成为 OpenAI 惯用的道歉方式。它不是现金退款或订阅延期,而是把已用掉的每周额度重新补满的使用额度补偿。Tibo 的帖子只提到了付费用户。据报道,OpenAI 在 8 月 25 日也曾因用户反映额度消耗快于预期,而为所有付费套餐重置了使用量。METAL 曾报道 Anthropic 为 Claude Code 的 5 小时额度推出收尾功能,这次事件再次表明,编程智能体公司最谨慎对待的资源终究是使用额度。

METAL 查阅的状态页面上还附有一条说明。OpenAI 表示,可用性指标是所有等级、模型和错误类型的汇总,因此个别客户的可用性可能因订阅等级、所用模型和 API 功能而有所不同。作为绕行方案推荐的 API 密钥登录也并非免费。据报道,API 使用按 token 单独计费,费用在订阅额度之外产生。

从记者的角度看,这 56 分钟留下的问题不是补偿,而是解释。OpenAI 正通过 以 API 开放 Codex 运行框架 等方式,把这个智能体推进其他公司的产品中;交给它迁移或大规模重构等长任务的团队,一小时的中断会同时耗掉额度和工作状态。OpenAI 内部在服务停摆时有备用 Codex,而客户方的备用方案只取决于各自准备了多少。把 23:34 那条"已找到根本原因"的记录变成公开的解释,会比重置额度更能挽回信任。

评论