每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

被高通收购的Modular,将Mojo语言全面开源

连编译器都以Apache 2.0协议开放...MiniMax已在以每分钟数十亿token的规模处理请求

불꽃 마스코트와 불타는 OSS 글자 — 모조 오픈소스 키비주얼

이미지: Modular

摘要

  • Modular将其编程语言Mojo全部以Apache 2.0许可证开源
  • Modular Cloud转为正式服务,正以每分钟数十亿token的规模为MiniMax M3模型提供服务
  • 支持的硬件从英伟达、AMD GPU扩展到AWS Trainium、谷歌TPU及高通芯片
오픈소스 라이선스
모조 컴파일러·툴체인 전체를 아파치 2.0으로 공개 (mojolang.org)
버전 정보
모조 1.0, 지난주 출시…코드 안정성 보장 포함
인수 관계
퀄컴이 모듈러 인수를 완료했다
모듈러 클라우드
console.modular.com에서 정식 서비스 개시, 오픈AI 호환 API 종량제 지원
미니맥스 M3 배포
분당 수십억 토큰 처리, 100만 토큰 컨텍스트 윈도우, MSA 희소 어텐션 적용
신규 지원 하드웨어
AWS 트레이니엄, 구글 TPU, 퀄컴 Cloud AI 100 Ultra·Dragonfly
엔지니어링 공수
새 하드웨어 이식 공수가 기존보다 10배 넘게 줄었다고 모듈러가 주장

Mojo连编译器也一并开源了

Modular将其自主研发的编程语言"Mojo"以Apache 2.0许可证全面开源。此次公开范围包括编译器及相关整个工具链,开发者由此可以自行扩展该语言本身,甚至将其移植到新的平台上。源代码及参与方式可在mojolang.org查看。

此次发布是在8月19日于美国旧金山举行的开发者大会"ModCon"主题演讲上宣布的。Modular在四年半前以"AI不会永远只运行在一种芯片上"的预判创立,此次发布被介绍为这一判断的成果。

从标准库到整个语言,分三步开放

Mojo的开源并非一步到位。2024年首先公开了标准库,2025年又开放了推理引擎MAX的内核。此次连编译器在内的整个语言全部公开,标志着三步开放计划的完成。Modular同时透露,该语言上周已达到正式版本1.0。1.0的核心是保证稳定性,即承诺今天写的代码不会因后续更新而突然崩坏。

Mojo此前一直支持macOS和Linux,Windows用户则必须借助WSL(适用于Linux的Windows子系统)。Modular表示,正在与微软Windows团队合作,准备推出原生Windows支持。

归入高通旗下的Modular,仍继续支持竞争对手芯片

此次发布恰逢高通完成对Modular收购之际。Modular表示,收购完成后,其平台仍将继续支持与高通直接竞争的硬件。Modular解释称:"只有当所有人都能立足其中,这个基础平台才能真正运转。"

实际上,此次将支持范围从英伟达、AMD GPU扩展到了AWS Trainium、谷歌TPU、高通Cloud AI 100 Ultra以及高通Dragonfly。所有这些硬件都运行在相同的建模API、服务工作流、编程语言及核心抽象层之上。Modular表示,将新硬件接入该平台所需的工程投入,比传统方式减少了10倍以上。合作伙伴HTEC仅用少数工程师、耗时数月,就独立实现了对谷歌TPU的支持。

Modular亮点
ModCon发布会亮点 · Modular

MiniMax展示的实战性能

Modular Cloud当天在console.modular.com正式转为商用服务。该服务提供两种方式:与OpenAI兼容、按token计费的共享API端点,以及可在自有或客户基础设施上运行的专属部署。

该服务在过去数月一直以"ModelRun"之名处理OpenRouter的流量,据独立基准测评机构Artificial Analysis数据显示,其在延迟和吞吐量方面均保持领先水平。

其中最具代表性的案例是MiniMax。MiniMax将自家模型M3以专属部署方式运行在Modular Cloud上,正以每分钟数十亿token的规模处理实际服务流量。M3结合了100万token上下文窗口、多模态处理能力,以及仅选取所需键值块以降低运算量的稀疏注意力技术"MSA(MiniMax Sparse Attention)"。Modular表示,其团队将该模型直接移植到MAX上,并针对MSA专门调优了内核,使其适配实际服务流量模式。

MAX开放与联盟计划

Modular还调整了推理引擎MAX的许可政策,扩大了源代码的可访问范围,目的是让开发者、企业、硬件厂商及合作伙伴能够直接扩展并参与该平台的建设。同时,公司表示正在筹备一项面向硬件厂商、模型开发商、云服务商及数据中心运营商的行业联盟计划。初创芯片公司d-Matrix也被提及为对该构想表示兴趣的公司之一。

如何上手体验

想体验Mojo 1.0的开发者可以在mojolang.org下载编译器、标准库及文档。在macOS和Linux上可直接安装,Windows用户目前仍需通过WSL使用。

注册Modular Cloud后,用户可以从模型目录中选择公开模型并直接通过共享端点调用,也可以上传自有模型以专属部署方式运行。由于采用与OpenAI兼容的API,只需更换端点地址,此前用OpenAI SDK编写的代码即可直接复用,这在实际使用中是最直观的便利之处。

现在想体验Modular Cloud,可前往Modular Cloud免费注册页面创建账户并查看模型目录。

编辑视角

Modular将Mojo彻底开源、同时又归入高通旗下,这一组合看似矛盾,但从时间线来看却颇为合理。由于收购方是特定的芯片公司,若语言和编译器继续保持封闭,很容易被外界固化为"高通专用工具"的印象。此次连编译器都以Apache 2.0开放、让任何人都能将其移植到新平台,可以被解读为一种信号:即便被收购,该语言仍要坚守中立标准的地位。

这一走向并非首次出现。当特定芯片厂商收购某项软件标准时,该标准若想存续,往往都附带一个条件——必须继续支持收购方竞争对手的产品。此前已支持英伟达和AMD GPU的Modular,此次一并接入高通自家芯片(Cloud AI 100 Ultra、Dragonfly)之外,还同时加入了亚马逊Trainium和谷歌TPU,可以说正是把这一条件付诸了实践。

对国内企业而言,值得关注的是其关于工程投入大幅削减的说法。HTEC仅凭少量人力、耗时数月便完成TPU适配的案例,可为正在筹备自研加速器的芯片初创企业或云服务商提供移植成本的参考基准。不过这一数据来自Modular一方的说法,实际移植难度仍会因具体硬件特性而有所不同。

未来数月值得关注的看点有两个:一是Modular Cloud将Trainium和TPU真正投入商用服务的速度有多快;二是行业联盟计划最终会吸引哪些公司加入。既然MiniMax这样的大型模型开发商已经用实际使用流量证明了性能,接下来的关键就在于,这一平台能否真正成长为整个行业的通用基础设施,而不只是某家芯片公司的专属工具。

评论