METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

NVIDIA Nemotron 4,瞄准万亿参数但仍落后中国

NVIDIA正在开发的开放权重模型Nemotron 4规模达万亿级,但Kimi K3、DeepSeek V4已经超过这一水平

NVIDIA Nemotron 4,瞄准万亿参数但仍落后中国

图片:METAL

摘要

  • 据悉,NVIDIA正在开发的开放权重模型Nemotron 4最大版本参数规模至少达1万亿,是Nemotron 3 Ultra的2倍
  • NVIDIA已将用于自研模型训练的云计算投资规模扩大3倍,至2031年将达280亿美元,新模型最快将于今秋发布
  • 即便达到万亿参数规模,仍不及Moonshot AI的Kimi K3(2.8万亿)和DeepSeek V4 Pro(1.6万亿),智能指数也存在差距

万亿参数,却依然排不进第二梯队

据The Information报道,NVIDIA正在筹备的下一代开放权重模型Nemotron 4最大版本正被设计为至少1万亿参数规模。这是去年6月推出的Nemotron 3 Ultra的2倍规模。但这一数字并不意味着跻身行业顶尖水平。据悉,Moonshot AI的Kimi K3拥有2.8万亿参数,DeepSeek的V4 Pro为1.6万亿参数。即便NVIDIA达到1万亿参数,也只是追上了中国实验室早已跨越的规模。

性能差距依然存在

参数量并不能直接保证性能,但从目前的基准测试来看差距十分明显。Nemotron 3 Ultra在发布时是当时开源的美国模型中最强的,但仍不及当时处于顶尖水平的Kimi K2.6。据悉,在Artificial Analysis Intelligence Index最新版本中,Nemotron 3 Ultra得分38分,Kimi K3得分约为60分。这20多分的差距,正是Nemotron 4需要跨越的门槛。

模型参数规模智能指数开发商
Nemotron 4(待发布)1万亿+未公开NVIDIA
Kimi K32.8万亿60Moonshot AI
DeepSeek V4 Pro1.6万亿未公开DeepSeek
Nemotron 3 Ultra(现行版本)Nemotron 4的一半38NVIDIA

280亿美元投入的原因

据悉,NVIDIA已将用于自研模型训练的云计算投资规模扩大3倍,至2031年将达280亿美元。作为一家销售GPU的公司,NVIDIA却亲自下场开发大语言模型,这背后有其利益考量:越多企业在自有服务器上运行开放模型,GPU需求也就越大。据本报8月8日报道,去年7月NVIDIA曾在有200多家企业和机构参与联署的"Open Weights and American AI Leadership"公开信上签名,表明其支持开放权重模型普及的立场。同一时期发布的物理AI模型Cosmos 3,也是这一开放战略的延续。

在监管与客户之间

与此同时,NVIDIA也在反对开放模型监管的请愿书上署名。这一时间点恰逢特朗普政府正考虑针对特定中国模型出台限制措施。问题在于,Nemotron 4越成功,NVIDIA就越会与OpenAI等其大客户直接展开竞争。既销售硬件、又销售用该硬件打造的模型,这种结构在客户眼中或许会被解读为一个微妙的信号。

那么,这会带来什么变化

据悉,Nemotron 4最快将于今秋发布。一旦正式亮相,基准测试成绩恐怕会比参数量更受关注。这一消息表明,万亿这一规模本身已不再能保证跻身顶尖水平。这也意味着,开放权重领域的竞争正从中美实验室之间的规模比拼,转向真正的智能指数差距的缩小。对NVIDIA而言,GPU销售与自研模型开发这两大业务能在多长时间内不发生冲突地共存,也值得持续关注。

评论