컴백부터 K-뷰티까지 — K-컬쳐의 모든 것을 메일로 받아보세요메일로 받아보기

METAL MEDIA

Comfy-Org/ComfyUI

129,104오늘 +179Python

코드 한 줄 없이 그림 그리듯 이미지·영상·음성 AI를 조립하는 도구, ComfyUI

ComfyUI는 이미지, 영상, 3D, 음성 생성 AI 모델들을 노드(작업 상자)를 선으로 연결하는 방식으로 실행하는 그래픽 프로그램이다. Stable Diffusion, Flux, Wan, HunyuanVideo 등 다양한 오픈소스 생성 모델을 코드 작성 없이 조합해 실행할 수 있다. 윈도우, 리눅스, 맥, 그리고 엔비디아·AMD·인텔·애플 실리콘 등 거의 모든 하드웨어에서 로컬로 돌아간다.

무엇을 하는 레포인가

  1. 무엇을: 이미지·영상·3D·음성·텍스트 생성 모델을 하나의 그래프(노드들이 선으로 이어진 작업 흐름도) 위에서 조립해 실행하는 창작 엔진이다.
  2. 어떻게: 각 기능(모델 불러오기, 인페인팅, 업스케일링, LoRA 적용 등)을 노드라는 상자로 만들고 이를 마우스로 연결해 워크플로우를 구성한다. 그래프에서 바뀐 부분만 다시 계산하는 방식으로 반복 작업 속도를 높인다.
  3. 결과: Stable Diffusion 1.5부터 SDXL, Flux.1, Flux.2, Qwen Image, Wan, HunyuanVideo 1.5 등 최신 오픈소스 모델을 기본 지원하며, 데스크톱 앱, 윈도우용 포터블 패키지, 수동 설치, 클라우드 버전으로 제공된다.
  4. 기타: 워크플로우를 JSON 파일로 저장하거나, 생성된 이미지 파일 자체에서 사용된 시드값까지 포함한 전체 작업 흐름을 복원할 수 있다. 기본적으로 오프라인으로 완전히 작동하며, `--disable-api-nodes` 옵션으로 유료 API 노드를 아예 끌 수 있다.

왜 중요한가

현재 가장 많이 쓰이는 오픈소스 이미지·영상 생성 AI 실행 도구 중 하나로, 코드를 몰라도 최신 생성 모델들을 직접 조합해 실험할 수 있게 해준다. 12만 개가 넘는 스타를 받을 만큼 개인 창작자부터 프로덕션 파이프라인까지 폭넓게 쓰인다.

이 레포의 용어

  • 노드/그래프 인터페이스 · 작업을 상자(노드)로 표시하고 선으로 연결해 흐름을 만드는 시각적 프로그래밍 방식
  • LoRA · 기존 AI 모델에 적은 용량의 추가 학습 데이터를 얹어 스타일이나 캐릭터를 바꾸는 경량 파인튜닝 기법
  • VAE · 이미지를 압축된 형태(잠재 공간)로 바꾸거나 복원하는 데 쓰이는 신경망 구성요소
  • 인페인팅/아웃페인팅 · 이미지의 일부를 지우고 다시 채우거나(인페인팅), 이미지 바깥 영역을 확장해 새로 그리는(아웃페인팅) 기능
  • 양자화 모델 · 모델 내부 숫자의 정밀도를 낮춰 용량과 연산량을 줄인 모델

레포 원문 소개 (영문)

The most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.

GitHub에서 보기

주목받는 레포

레포 전체 보기 →

METAL MEDIA 최신 기사