K-文化的一切——从回归到 K-美妆,发送到您的邮箱订阅邮件

METAL MEDIA

Comfy-Org/ComfyUI

129,104今日 +179Python

不用写代码,靠拖拽连线就能搭建图像、视频、音频AI流程的工具

ComfyUI是一款图形化程序,通过在图形界面上连接节点(而不是写代码)来运行图像、视频、3D、音频等生成式AI模型。它原生支持Stable Diffusion、Flux、Wan、HunyuanVideo等大量开源模型。它可以在Windows、Linux、macOS上本地运行,支持Nvidia、AMD、Intel、Apple Silicon等多种硬件,也提供云端版本。

它做什么

  1. 做了什么:ComfyUI是一个创作引擎,让用户在节点图(由连线组成的可视化工作流程图)上组合图像、视频、3D、音频、文本生成模型,无需编写代码。
  2. 怎么做的:加载模型、局部重绘、放大、应用LoRA等每个功能都被做成一个节点,用户用鼠标连线搭建工作流。系统只重新执行图中发生变化的部分,提升重复操作的效率。
  3. 结果:原生支持从Stable Diffusion 1.5到SDXL、Flux.1、Flux.2、Qwen Image、Wan、HunyuanVideo 1.5等一系列最新开源模型,并提供桌面应用、Windows便携版、手动安装及付费云端版本等多种使用方式。
  4. 其他:工作流可以保存为JSON文件,生成的图片本身也能被重新拖入以完整还原当时使用的工作流和随机种子。软件默认完全离线运行,使用`--disable-api-nodes`参数可以彻底关闭可选的付费API节点。

为什么重要

ComfyUI是目前使用最广泛的开源图像视频生成AI工具之一,让不会写代码的人也能自由组合最新的生成模型进行创作实验。它在GitHub上获得超过12.9万个星标,从个人创作者到生产流程都在广泛使用。

本仓库术语

  • 节点/图形界面 · 一种可视化编程方式,把任务显示为方框(节点)并用连线定义工作流程
  • LoRA · 在已有AI模型基础上叠加少量额外训练数据的轻量级微调方法,用于改变风格或角色
  • VAE · 用于将图像压缩为更小表示形式(潜在空间)并再还原回来的神经网络组件
  • 局部重绘/扩展绘制 · 局部重绘是擦除并重新填充图像的一部分;扩展绘制是在图像原边界之外继续生成新内容
  • 量化模型 · 内部数值使用更低精度以减少体积和计算量的模型

仓库简介(英文)

The most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.

在 GitHub 打开

热门仓库

全部仓库 →

METAL MEDIA 最新报道