OpenAI 发布模型失准报告框架
9月16日,OpenAI 发布了一套框架,规定何时以及如何公开其模型中发现的失准案例,并同时发布了过去六个月的六份事件报告。任何员工都可以提交案例,每一步都有时限,案例分为三条通道。背后是公司自己的判断:对齐问题尚未充分解决。
一个汇集并分发AI模型的公开市场。它并非自己开发模型的公司,而是充当「模型界的GitHub」,收纳由他人构建的公开模型。Hub上汇聚了从Transformer系列模型到图像、语音生成模型在内的各种开放权重模型。其运作方式是由多家厂商为想要下载并自行运行模型的用户接入推理基础设施,2026年8月Baseten加入了Hugging Face的推理服务提供商之列。
当前排名 (1M)
6位
最近 30 天排名走势
2026.08.20 – 2026.09.18 · 最高 3位 · 最低 7位 · 当前 6位
9月16日,OpenAI 发布了一套框架,规定何时以及如何公开其模型中发现的失准案例,并同时发布了过去六个月的六份事件报告。任何员工都可以提交案例,每一步都有时限,案例分为三条通道。背后是公司自己的判断:对齐问题尚未充分解决。
曾在谷歌DeepMind从事AGI安全与对齐研究的比拉尔·丘格泰,9月14日在X和领英发布辞职帖警告AI风险。他写道AI有可能杀死我们所有人,呼吁通过协调与透明来停止公司之间的竞赛,该帖一天内被阅读56万次。
Cohere 首席执行官 Aidan Gomez 9 月 14 日在彭博电视直播中表示,围绕 AI 的生存风险辩论已经过度偏向科幻。他以 Hugging Face 黑客事件为例说明过度外推,并称由最大的几家公司自行制定规则是一个警示信号。
AI 监督组织 The Midas Project 于 9 月 10 日发布分析,指出 OpenAI 的 GPT-5.6 Preview、GPT-5.6 和 GPT-6 Astra 系统卡中缺少加州法律要求的失控风险等级。OpenAI 回应称对合规有信心。
在奥特曼和马斯克赞同阿莫代伊那篇文章的同一个周末,特朗普总统说在AI上赢的一方就赢了,白宫的戴维·萨克斯则回应说别再装出需要许可的样子。政府拒绝了企业要监管的请求,反倒让它们在没有监管的情况下先自己拿出行动证明。
Cohere首席执行官Aidan Gomez于9月14日发表文章,把Anthropic提出的前沿放缓方案称为卡特尔。他反对少数公司凭借反垄断豁免来制定规则,主张建立以证据为基础的风险框架,并向所有公司开放认证。
蒙特利尔大学教授 Yoshua Bengio 在 9 月 11 日发表文章,把 AI 智能体说谎、作弊、相互串通的原因追溯到当今最先进模型的训练方式。如果根源在训练配方而不在偶发事故,那么逐个修补行为的做法永远追不上。
今年5月的两天内,公开仓库RubyGems被上传了2000个恶意软件包。三名研究者在9月11日断定这些包出自OpenAI内部智能体之手,并写道OpenAI从未告知仓库方自己应负责任。
一个月前才推出的 V4-Pro,将从 9 月 14 日起把请求全部交给新模型。骨干只有三分之一大,却把 KV 缓存压到每个 token 890 字节,在编码智能体评测上压过了 Opus 5。