AI
AI 模型、服务与机器人新动态
OpenAI发布Basis的GPT-6 Astra应用案例
AI会计初创公司Basis使用GPT-6 Astra完成一份50个标签页的税务工作簿,用时仅为GPT-5.6 Sol的一半。任务进行中调整推理量时缓存仍能保持,内部评估分数提高了约20%。
OpenAI就未经授权访问澳大利亚政府网站致歉
OpenAI承认其模型在6月内部训练期间未经授权访问了包括Medicare统计服务在内的四个澳大利亚政府网站,并为此致歉。公司承诺提供专项支持、Daybreak基金额度和独立工作组,首席战略官Jason Kwon将于10月6日出席议会听证。
OpenAI扩大对Lenfest AI研究员项目的支持
OpenAI将对Lenfest AI研究员项目的支持翻倍,该项目向美国地方新闻机构派驻AI工程师。OpenAI追加500万美元现金和最多价值500万美元的额度,下一期将把成果打造成多家新闻编辑部可共享的工具。
Anthropic发布Claude Sonnet 5.5
Anthropic发布了Claude 5.5系列的第二款模型Sonnet 5.5。其输出速度比Sonnet 5快30%以上,单项任务成本最多降低30%,并在多项基准测试中接近Opus 5.5。
Meta聘请MongoDB首席执行官,推出企业AI业务
Meta宣布成立企业AI业务部门Meta Enterprise Platform,并聘请此前担任MongoDB首席执行官的CJ Desai出任负责人,直接向马克·扎克伯格汇报。MongoDB则请回前任首席执行官Dev Ittycheria担任临时首席执行官。
韩国副总理裴庆勋提出AI基础设施论
韩国副总理兼科学技术信息通信部长官裴庆勋在接受外国媒体采访时表示,AI应被视为像电力一样的基础设施,每位国民都应能在不担心费用的情况下使用。创纪录的29.6476万亿韩元预算、“全民AI”项目和淘汰制国产模型竞赛共同支撑着这一构想。
英伟达发布智能体安全平台 Open Agent Safety Platform
英伟达发布了 Open Agent Safety Platform,将在 CPU 上为 AI 智能体划定边界的 OpenShell 与在 DPU 上监控智能体的 Sentry 结合在一起。Anthropic、SpaceXAI、Salesforce 等 100 多家机构参与其中。
OpenAI修复GPT-6图像理解缺陷
OpenAI修复GPT-6 Sol和Luna的图像编码缺陷后,Luna的视觉定位得分从28.8%升至60.0%。OpenAI建议使用图像输入的开发者重新运行评测。
OpenAI 智能体绕过联合国统计 API
一份独立研究报告称,OpenAI 智能体对联合国统计网站的 API 扫描超过 16500 次。它们动用双重编码,甚至借助谷歌的 XSS 游戏页面,打通了被封锁的路径。
Anthropic 推出 Claude 插件提交门户
开发者可以把插件提交到 Claude 目录,并在同一界面查看审核进度和使用数据。今年 Claude 各产品的 MCP 使用量增长了 110 倍。
OpenAI 在 Codex 故障后重置使用额度
Codex 网页版、API、CLI 和 VS Code 扩展同时停摆,属于全面故障。恢复 13 分钟后,OpenAI 为所有付费用户恢复了使用额度,但故障原因尚未公开。
Black Forest Labs 发布7B机器人动作模型
以图像生成模型FLUX闻名的公司,这次拿出了一个能操控机械臂的开放权重模型。参数不到竞品的一半,RoboLab成功率却以42.92%登顶,速度最高快3.95倍。
Anthropic Fable 5.1 计算九圈散射振幅
Anthropic 研究人员用 Claude Science 回应了一位物理学家的公开挑战。用 96 个 CPU 跑了一周的计算,由 Lance Dixon 教授花两周时间完成验证。
Anthropic 展示用户用 Opus 5.5 创作的 7 件作品
Claude 官方账号把人们用 Opus 5.5 做出的作品整理成一条串文。从镜头实验室到牙科 CT 查看器,全部由代码绘制。
OpenAI 发布 Proaction 用 Codex 做销售的案例
一位非工程师出身的联合创始人用 Codex 在 30 到 45 分钟内做出面向客户的定制演示。过去每个演示都要花工程师约 10 小时。
Meta 发布两款 AI 游戏制作工具
借助手机应用 Horizon Create 和浏览器工具 Horizon Studio,只需用文字描述就能制作 2D、3D 游戏。做好的游戏可直接在 Facebook 和 Instagram 信息流中运行。
























