Comfy-Org/ComfyUI
不用写代码,靠拖拽连线就能搭建图像、视频、音频AI流程的工具
ComfyUI是一款图形化程序,通过在图形界面上连接节点(而不是写代码)来运行图像、视频、3D、音频等生成式AI模型。它原生支持Stable Diffusion、Flux、Wan、HunyuanVideo等大量开源模型。它可以在Windows、Linux、macOS上本地运行,支持Nvidia、AMD、Intel、Apple Silicon等多种硬件,也提供云端版本。
它做什么
- 做了什么:ComfyUI是一个创作引擎,让用户在节点图(由连线组成的可视化工作流程图)上组合图像、视频、3D、音频、文本生成模型,无需编写代码。
- 怎么做的:加载模型、局部重绘、放大、应用LoRA等每个功能都被做成一个节点,用户用鼠标连线搭建工作流。系统只重新执行图中发生变化的部分,提升重复操作的效率。
- 结果:原生支持从Stable Diffusion 1.5到SDXL、Flux.1、Flux.2、Qwen Image、Wan、HunyuanVideo 1.5等一系列最新开源模型,并提供桌面应用、Windows便携版、手动安装及付费云端版本等多种使用方式。
- 其他:工作流可以保存为JSON文件,生成的图片本身也能被重新拖入以完整还原当时使用的工作流和随机种子。软件默认完全离线运行,使用`--disable-api-nodes`参数可以彻底关闭可选的付费API节点。
为什么重要
ComfyUI是目前使用最广泛的开源图像视频生成AI工具之一,让不会写代码的人也能自由组合最新的生成模型进行创作实验。它在GitHub上获得超过12.9万个星标,从个人创作者到生产流程都在广泛使用。
本仓库术语
- 节点/图形界面 · 一种可视化编程方式,把任务显示为方框(节点)并用连线定义工作流程
- LoRA · 在已有AI模型基础上叠加少量额外训练数据的轻量级微调方法,用于改变风格或角色
- VAE · 用于将图像压缩为更小表示形式(潜在空间)并再还原回来的神经网络组件
- 局部重绘/扩展绘制 · 局部重绘是擦除并重新填充图像的一部分;扩展绘制是在图像原边界之外继续生成新内容
- 量化模型 · 内部数值使用更低精度以减少体积和计算量的模型
仓库简介(英文)
The most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.
在 GitHub 打开热门仓库
- Alishahryar1/free-claude-code一个本地代理,把编程AI助手接到49家免费或低价模型服务商,不再只能用一家付费服务
- freestylefly/awesome-gpt-image-2把532个GPT-Image2案例拆解成可复用模板的提示词工程库
- block/buzz一个让人类和AI智能体在同一空间里聊天、写代码、做审查的开源协作平台
- NousResearch/hermes-agentNous Research推出的Hermes是一款越用越聪明的AI智能体
- virgiliojr94/book-to-skill把技术类书籍PDF变成AI编程助手随时可查阅的技能包
- VoltAgent/awesome-agent-skills把上千份让AI编程助手秒变专家的操作手册集中放在一个地方
- anthropics/claude-plugins-community一个把大家做的Claude插件集中起来供安装的仓库
- dani-garcia/vaultwarden用Rust写的非官方Bitwarden服务器,更轻量,适合自己搭