METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

AI 术语词典ㅅ基础设施与芯片

serving engine

让训练好的AI模型能在实际服务中快速、稳定运行的软件。

简单来说

serving engine(服务引擎)是把已经训练好的AI模型真正变成人们可以使用的运行程序。如果把模型比作一份食谱,服务引擎就相当于拿到这份食谱后,在真实厨房里同时处理成百上千顾客订单的厨房系统。再好的食谱,如果厨房效率低下、一次只能做一盘菜,也接待不了太多顾客;同样,模型再强,如果服务引擎不给力,响应就会变慢,也没法让很多人同时使用。

具体来说,服务引擎会把多个人的请求打包在一起处理(就像外卖软件把附近的订单合并成一次配送),并且管理GPU的显存,让它被高效分配、不被浪费。当一个新的开放模型发布时,这个服务引擎是否能立刻支持它,决定了这个模型能多快真正用到实际服务当中。

在报道中是这样出现的

文章中提到,vLLM的首席维护者谈到了在「50万块GPU规模」下将开放模型运行于生产环境的经验。像vLLM这样的项目所做的,正是服务引擎的角色。一个常见的误解是「模型好,服务自然就能跑好」,但实际上,除了模型本身,还需要一个能够大规模稳定运行它的服务引擎。

亲手试一试

下次看到新开放模型发布的消息时,留意一下是否同时提到了支持该模型的服务引擎。如果出现「发布当天即支持」之类的说法,这就是判断该模型能多快真正投入实际服务的一个线索。

相关词条

出现过这个词的报道

浏览全部词条