每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

OpenAI 14倍加速推理实验,Anthropic挑战黎曼猜想

本周OpenAI主打速度与安全,Anthropic则拿出数学与风险管理成果

이미지: X — 뉴스 앰프 영상 갈무리

摘要

  • OpenAI公开了让GPT-5.6 Sol在Cerebras硬件上最快提速14倍的"Ultrafast"模式,以有限API预览形式推出
  • Anthropic表示其未公开的研究用Claude将黎曼猜想的下界从41.6%提升至67.2%,同时将内部模型"Model 2"的对齐失败风险等级由"低"上调
  • OpenAI前COO Brad Lightcap离职、新任CRO加入等两家公司的人事变动也集中在同一周出现
原文视频
Ultrafast 모드
GPT-5.6 Sol을 Cerebras 하드웨어에서 최대 14배 빠르게 구동, 제한적 API 프리뷰
Daybreak 확장
보안 이니셔티브 Daybreak를 AWS 환경으로 확대
리만 가설 하한
미공개 연구용 클로드 모델이 41.6%에서 67.2%로 상향
내부 모델 Model 2
Mythos 5보다 다소 향상, 정렬 실패 위험 등급 '매우 낮음'→'낮음'
인사 이동
달리 라지치 CRO 합류, 데니즈 드레서·전 COO 브래드 라이트캡 퇴사
Sonnet 5 요금
출시 초기 요금제를 영구 적용으로 전환
텍스트 워터마크
앤스로픽이 도입 예정인 클로드 텍스트 워터마크 방식을 설명

在一周之内出现了一次实验,让ChatGPT的回答最快能提速14倍;与此同时,Anthropic那边传出消息称,一款未公开的研究用Claude将困扰数学界百余年的黎曼猜想的下界向上推进了一步。把两家公司在同一周内发布的内容放在一起看,可以看出它们当下各自在把力气花在什么地方。

이미지: X — 뉴스 앰프

14倍加速推理,借Cerebras上阵测试

OpenAI公开了让GPT-5.6 Sol最快提速14倍的"Ultrafast"模式,目前以有限API预览形式推出。据悉该模式基于芯片企业Cerebras的硬件运行,目标是缩短用户等待回答所需的时间。目前仅向部分开发者开放,处于早期阶段,普通用户暂时还无法在ChatGPT界面上直接感受到这一变化。

安全专用体系,扩展至AWS

OpenAI此前已于8月10日公开了网络安全专用模型GPT-5.6-Cyber,并表示已建立面向防御工作的Daybreak Blue以及面向经授权漏洞研究的Daybreak Red两套体系。本周该公司透露,已将Daybreak体系扩展至亚马逊云服务(AWS)环境。据悉,只有获得授权的防御团队才能访问GPT-5.6-Cyber这一原则依旧保持不变。

Claude触及的黎曼猜想,下界升至67.2%

Anthropic表示,一款尚未公开的研究用Claude模型将与黎曼猜想相关的下界(lower bound)数值从41.6%提升到了67.2%。黎曼猜想是解释素数分布的数学界长期难题。虽然AI并未完成证明本身,但在短时间内大幅提升了相关数值,这一结果足以引起数学界的关注。

内部模型"Model 2",风险等级反而上调

Anthropic在发布第二份风险报告(Risk Report)时,披露了一款未对外公开的内部模型"Model 2"的存在。据介绍,该模型性能略优于此前推出的"Mythos 5",与此同时,公司将其对齐失败(misalignment)风险等级由"极低"上调了一档,调整为"低"。这也意味着,公司自己也在强调:模型能力越强,意外行为的风险管理也需要同步跟进。

水印与人事变动

Anthropic介绍了即将引入的文本水印方案,将Chrome侧边栏中的Claude功能改为"Cowork(协作)"会话,并决定将Sonnet 5发布初期的定价永久保留。同一周,OpenAI方面,达利·拉吉奇(Dali Rajic)以首席营收官(CRO)身份加入,丹尼斯·德雷瑟(Denise Dresser)宣布离职,前首席运营官(COO)Brad Lightcap也被宣布将离开公司。将这些人事消息与产品发布并列来看,意味着两家公司都在同步进行组织调整。

编辑视角

把这一周的发布内容摆在一起,两家公司的战略差异便清晰地显现出来。OpenAI同时推进速度(Ultrafast)与安全(Daybreak·Cyber)这两条主线,持续增加企业客户能够实际使用的工具。相比之下,Anthropic在同一周内既拿出了黎曼猜想下界提升这一研究成果,又发布了主动上调自家模型风险等级的风险报告,反复传递出"我们在能力提升的同时也在管理风险"的信息。这并非巧合,而是两家公司正在向不同受众发声的信号:OpenAI在对开发者和企业IT负责人说话,Anthropic则在对监管机构和研究界说话。

从实务角度看,需要关注的和可以先放一放的内容也随之分明。Ultrafast模式目前仍处于有限API预览阶段,还无法立即接入正式服务,但对于响应延迟一直是痛点的团队来说,现在正是登记候补名单的时机。而黎曼猜想或Model 2之类的消息,更适合理解为暂时不会影响实际业务的研究、宣传性质的发布。对齐失败风险等级上调这一点,与其视为需要恐慌的信号,不如理解为模型性能与风险管理同步增长的正常曲线。

放在以前,这种风险等级上调很可能会被悄悄带过,或者只是以脚注形式处理,但如今的变化在于,两家公司都在把定期公开风险报告固化为一种惯例。下周值得关注的是,Ultrafast模式的公开范围是否会进一步扩大,以及Anthropic是否会以某种形式对外公开这款与黎曼猜想相关的研究模型。