每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

agent-substrate/substrate

1,275今日 +26Go

谷歌开源系统:把几百个AI智能体塞进几台服务器里运行

Agent Substrate把大量大部分时间处于空闲状态的AI智能体进程,集中调度到少量共享服务器上以节省资源。它构建在Kubernetes之上,能在一秒以内挂起和恢复一个智能体,从而让系统看起来拥有远超实际数量的工作节点。演示中,它用仅8个物理Pod运行了250个有状态的智能体。

它做什么

  1. 系统登记的智能体(actor)数量远多于实际的工作服务器(worker),利用智能体类应用大部分时间处于空闲的特点,把它们复用到少量服务器上
  2. 智能体运行在microVM或gVisor等隔离技术中,可在一秒以内完成挂起与恢复,并通过完整状态快照保留内存和文件系统状态
  3. 它不是用来编写智能体的SDK,而是用来大规模运行已建好的智能体的基础设施,不挑框架,支持ADK、LangChain、Claude Code、MCP服务器等
  4. 在Kubernetes的Pod与自动扩缩容之上叠加了针对智能体的专用调度,演示中用8个物理Pod同时运行了250个有状态的actor
  5. 项目自述目前处于早期开发阶段,尚不适合生产环境使用,API预计还会发生变化

为什么重要

在生产环境运行基于大模型的智能体时,通常每个智能体都要持续占用服务器资源,成本会迅速攀升;这个项目利用智能体大部分时间空闲这一特点,试图改变这种成本结构。由于它在容器层面工作、不绑定特定智能体框架,对需要同时大规模运行多种智能体技术栈的团队具有直接参考价值。

本仓库术语

  • gVisor · 谷歌开发的容器沙箱技术,在内核层面隔离执行环境
  • microVM · 比传统虚拟机启动更快、更轻量的微型虚拟机
  • actor(智能体实例) · 系统管理的单个智能体/应用实例
  • worker(工作节点) · 实际运行actor的物理资源单元,即Kubernetes Pod
  • 超额订阅(oversubscription) · 登记的工作量超过实际容量,按需动态分配资源的方式

仓库简介(英文)

Agent Substrate: the core system

在 GitHub 打开

热门仓库

全部仓库 →

METAL LAB 最新报道