ComfyUI 是一个开源的 AI 创作引擎,用“搭积木”的方式把 AI 生成图片、视频、3D 模型、音频的过程可视化:每一步处理都做成一个模块(节点),用线连起来组成工作流,点一下运行就出结果。它解决的核心问题是——很多 AI 生成工具是“黑盒”,只能填提示词、点按钮,中间过程完全不可控;而 ComfyUI 把每一步都摊开给你看、给你改。它适合 AI 绘画与视频创作者、视觉设计师,以及想在应用里集成 AI 生成能力的开发者,尤其是追求精细控制和批量产出的人。

截至 2026 年 8 月,ComfyUI 在 GitHub 上已有 130k star(收藏数)、15.3k fork(衍生拷贝数),341 位贡献者,累计 5822 次提交;最新稳定版 v0.33.1 发布于 2026 年 8 月 13 日,采用 GPL-3.0 开源许可,代码以 Python 为主(占 99.7%)。

它怎么工作:节点图

节点图是 ComfyUI 的核心。节点(node)可以理解成一个功能块——有的负责读入图片,有的负责把文字提示词转成模型能理解的形式,有的负责最终生成图像。把需要的节点拖到画布上,用线按顺序连起来,就形成一条“流水线”,也就是工作流(workflow)。整个过程不用写代码,鼠标拖拽即可搭建;生成结果不满意,直接改中间任意节点的参数再运行即可,不必从头再来。

它支持哪些模型和内容

ComfyUI 原生支持当前主流开源模型(models,即 AI 的“大脑”),覆盖多种内容类型:

  • 图像生成:Stable Diffusion 系列(SD1.5、SDXL、SD3.5)、Flux.1/Flux.2、Qwen Image 等——Stable Diffusion 是最知名的开源 AI 绘图模型;
  • 视频生成:Wan 2.1/2.2、LTX-Video 2、HunyuanVideo 1.5、CogVideoX 等;
  • 音频生成:ACE-Step、Stable Audio 3 等;
  • 3D 生成:Hunyuan3D 2.1 等;
  • 文本生成:Gemma、Qwen3 系列(含多模态版本)。

也就是说,别人训练好的 AI 模型只要格式兼容,基本都能装进 ComfyUI 使用;近年新发布的视频与音频模型(如 MiniMax H3、LTX-Video 2.3)也都在支持列表内。

为什么说它“模块化”

一是组件可复用:搭好的工作流可以保存为 JSON 文件,分享给他人直接加载,也可以当模板反复使用;生成的图片里还内嵌了完整工作流信息,把图片拖回软件就能复原当时的生成参数。

二是扩展开放:通过自定义节点(custom nodes)机制,任何人都能写新的功能块加进去,社区贡献了大量节点与插件,配套的 ComfyUI-Manager 可以一键安装、更新、管理这些插件。

三是执行智能:它只重新执行工作流里被改动的部分,支持异步排队(多个任务排队依次执行);还能自动管理显存(VRAM,显卡内存),放不下的大模型会部分卸载到普通内存,低配置电脑也能跑大模型。

离线与生产接入

ComfyUI 默认完全离线运行,核心代码不会擅自下载任何东西;它还提供本地 API(应用程序编程接口,程序间通信的规范),可以把搭好的工作流嵌进自己的应用或生产流水线,并用 App Mode 把复杂工作流包装成简单界面,给不懂技术的终端用户使用。

怎么开始使用

  • 新手推荐:官方桌面应用,支持 Windows 与 macOS,安装即用(comfy.org/download);
  • Windows 便携版:解压即用,免安装;
  • 进阶手动安装:支持 Windows / Linux / macOS 以及 NVIDIA、AMD、Intel、Apple Silicon 等各类 GPU;
  • 本地硬件不够:可用官方付费云服务 Comfy Cloud。

一句话能带走的结论是:ComfyUI 是一个把 AI 生成过程“可视化、搭积木化”的开源引擎——用节点图连接每一步处理,支持图像、视频、音频、3D 与文本生成,可完全离线运行,工作流可保存、可复用、可编程接入。它是目前视觉 AI 创作领域的事实标准之一,130k star 与每周迭代持续验证着这一点;想认真玩 AI 绘画与视频生成,从它入手基本不会走弯路。