Anthropic 公开生物学模型优化代码
Anthropic 于 9 月 17 日公开了 Claude 对 36 个开源生物学模型实现所做优化的结果与代码。在不到四周的时间里,结构预测平均快了 4.1 倍,核糖体这类巨型分子机器也能在一个 GPU 节点上折叠出来。
AI 模型、服务与机器人新动态
Anthropic 于 9 月 17 日公开了 Claude 对 36 个开源生物学模型实现所做优化的结果与代码。在不到四周的时间里,结构预测平均快了 4.1 倍,核糖体这类巨型分子机器也能在一个 GPU 节点上折叠出来。
OpenAI 于 9 月 17 日推出 Astra for Law,把 GPT-6 Astra 配置成面向法律业务的形态。它不是新模型,而是在模型之上加了覆盖 2.3 亿个以上网址的法律检索索引、法律分析与写作指令,以及面向律所的管控。
Nous Research 于 9 月 16 日为 Hermes Agent 开放插件目录,起步时有 4 个官方插件和 96 个社区插件。安装固定到提交哈希,权限需要同意,安装时运行安全扫描,文档还明确写道:收录不等于代码审计。
多伦多初创公司 smartARM 在 9 月 16 日 Meta 新闻室发布的视频中展示了一款仿生手臂原型:手掌摄像头配合 Meta 开源视觉模型 DINOv2 识别物体并自行选择抓握方式。只需几张照片就能学会新物体,Meta AI 眼镜则成为它的第二双眼睛。
9月16日,OpenAI 发布了一套框架,规定何时以及如何公开其模型中发现的失准案例,并同时发布了过去六个月的六份事件报告。任何员工都可以提交案例,每一步都有时限,案例分为三条通道。背后是公司自己的判断:对齐问题尚未充分解决。
OpenAI于9月16日发布了一份管理员指南,将ChatGPT Work和Codex的使用量、任务和绩效数据与业务价值联系起来。该公司表示,分析数据只是一个起点,实际价值仍需业务负责人自行核算。
Anthropic 于 9 月 16 日把 Claude Cowork 和聊天合并进同一个对话,并推出 Claude Docs 与 Claude Slides。任务该交给哪里,现在由 Claude 来判断。
OpenAI于9月16日与部分美国广告主一起启动了赞助智能体测试,点击ChatGPT广告后用户可以与该企业赞助的智能体对话。当天还上线了用自然语言创建广告系列的Ads Manager插件,以及与HubSpot、Shopify的整合。
OpenAI学院联合AARP旗下的OATS机构,于9月16日在美国10个城市为1000名老年人举办了免费线下ChatGPT工作坊。过去一年里,美国55岁以上用户发送的消息占比已从6%升至接近10%。
ChatGPT官方账号9月15日宣布,GPT-5.5将于10月14日从ChatGPT、ChatGPT Work和Codex的所有套餐中下线。OpenAI开发者账号随即明确划清界限,表示通过API以及使用API密钥验证的Codex会话仍可继续使用该模型。
OpenAI 开发者账号 9 月 15 日发布了 Cognition 联合创始人 Walden Yan 的一分钟视频。在 Devin 里,GPT-6 Astra 用测试来证明代码确实能跑,从而减少人需要亲自审阅的代码量。
Sakana AI于9月16日为其研究智能体Sakana Marlin新增了Interactive Reading和PowerPoint导出功能。点击引用,AI会指出来源中的依据段落;研究结果则可导出为可编辑的幻灯片。
Google于9月15日以高级副总裁James Manyika的名义发布了一篇综述,回顾覆盖300种语言、70亿人的二十年语言AI研究。它的骨架是直接处理音频而不只是翻译文本的模型,以及由语言社区自己录制的语言数据。
Google Research 于 9 月 15 日发布了把搜索结果作为一个整体集合返回的 Retrieve-for-Train 框架,并附上 ICML 2026 论文。只跑一次强化学习来训练一个小型扩散模型,查询扩展速度提高了 12 到 20 倍。
Anthropic 开发者账号 9 月 16 日发布了一段在旧金山 Frontier Day 拍摄的 2 分 7 秒创业者访谈视频。Spawn、Hex、Sazabi、Phylo 四家公司讲述了此刻在 Claude 之上打造公司的样子。
谷歌于9月15日以谷歌研究院副总裁 Yossi Matias 和首席可持续发展官 Kate Brandt 的名义发布了一份26页的危机韧性白皮书。从提前7天的洪水预报、提前15天的气旋预报,到预警转化为现金援助和暂停还贷的案例,白皮书把公司的 AI 灾害预测业务整理成一册。
谷歌于9月15日发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。这两款语音模型能在对话中后台调用工具、边推理边说话,其中 Extended Thinking 以82.6分登上 Speech to Speech Quality Index 榜首。
Meta 于 9 月 15 日在全球开放订阅服务 Meta One,打包 Instagram、Facebook、WhatsApp 和 Meta AI。个人套餐提高 AI 图片与视频生成用量,创作者与企业套餐则把关注按钮和商业智能体做成月费出售。
Anthropic 于 9 月 15 日将 Salesforce in Claude 开放公测。这款插件把客户账户和销售管道拉进 Claude,内置 37 项销售技能,是 8 月 26 日宣布的 Claudeforce 合作的首个产品。
曾在谷歌DeepMind从事AGI安全与对齐研究的比拉尔·丘格泰,9月14日在X和领英发布辞职帖警告AI风险。他写道AI有可能杀死我们所有人,呼吁通过协调与透明来停止公司之间的竞赛,该帖一天内被阅读56万次。
腾讯混元团队9月15日公开了信息演化数据框架EvolveScaler的论文和项目页面。用先以代码定义状态、再渲染成自然语言的数据测试14个模型,在最长难度层级上avg@5中位数跌至11.3。
Nous Research 于 9 月 14 日发布了 Hermes Agent 的团队版 Hermes Business 和本地部署版 Hermes Enterprise。在共享余额和成员上限之上,叠加了一个无论谁创建、全团队都能使用的技能库。
微软研究院在 9 月 14 日的 Research Focus 中介绍了一篇分析 GitHub Copilot 编码智能体真实使用记录的论文。在 7.61 亿次 LLM 调用中,87% 由智能体自行发起;工具一旦失败,计算量最多膨胀 4 倍。
Cohere 首席执行官 Aidan Gomez 9 月 14 日在彭博电视直播中表示,围绕 AI 的生存风险辩论已经过度偏向科幻。他以 Hugging Face 黑客事件为例说明过度外推,并称由最大的几家公司自行制定规则是一个警示信号。