METAL

Lovable与Cerebras达成AI响应速度基础设施合作

Lovable与Cerebras联手,计划到2027年前打造大幅缩短响应延迟的基础设施。自2024年11月服务上线以来,累计项目数已突破5000万个。

Lovable与Cerebras达成AI响应速度基础设施合作

摘要

  • Lovable与Cerebras达成合作,将分阶段引入专用基础设施以提升AI响应速度。
  • Cerebras的晶圆级引擎将整个模型部署在单个硅晶圆上,从而消除芯片间通信成本。
  • 双方计划优先转换对延迟敏感的工作负载,并将陆续公开进展情况。

5000万个项目与"等待时间"这堵墙

Lovable是一个像对话一样通过AI来创建应用和网站的平台。用户只需描述自己想要的内容,AI就会实时生成可运行的原型,再通过简单的反馈进行完善并部署上线。自2024年11月服务上线以来,通过Lovable创建的项目数已突破5000万个。

该平台的核心流程是"描述→查看结果→迭代"。然而,如果各环节之间夹杂着等待响应的时间,工作流程就会被打断。Lovable决定投资基础设施,正是为了缩短这种"等待时间"。

Cerebras晶圆级引擎的工作原理

一般的AI系统会将模型的内存分散到数十个独立芯片上。芯片之间每次交换信息都会产生"通信成本",这也是造成响应延迟的原因之一。Cerebras采取了不同的方法。其晶圆级引擎(Wafer-Scale Engine)将整个模型部署在一块巨大的硅晶圆上,从而彻底消除芯片间通信。

Cerebras方面表示,这种结构在像软件开发这样需要反复交互的环境中尤其有效,能够加速现有GPU中最慢的环节。Cerebras联合创始人兼CEO安德鲁·费尔德曼(Andrew Feldman)表示:"当AI能够实时响应时,用户会做更多事情、停留更长时间,并完成更有价值的工作。"

分阶段转换计划与目标时间

Lovable的目标是到2027年大幅缩短响应时间。公司并未选择立即全面转换,而是采取分阶段方式,优先将对延迟最敏感的工作负载迁移至Cerebras专用算力。各转换阶段的进展将陆续公开。

Lovable联合创始人兼CEO安东·奥西卡(Anton Osika)表示:"我创办Lovable的初衷,就是让最贴近问题的人能够亲自解决问题。""Cerebras正在帮助Lovable以客户思考的速度做出响应。"

价格、支持范围与限制事项

目前的信息中并未提及此次基础设施转换相关的具体价格变动或计费方式,也没有说明支持的地区和模型范围。转向Cerebras专用算力的完成时间,以及各阶段的具体日程也尚未公开。公司表示,相关进展将在日后公布。

评论