Comfy-Org/ComfyUI
코드 한 줄 없이 그림 그리듯 이미지·영상·음성 AI를 조립하는 도구, ComfyUI
ComfyUI는 이미지, 영상, 3D, 음성 생성 AI 모델들을 노드(작업 상자)를 선으로 연결하는 방식으로 실행하는 그래픽 프로그램이다. Stable Diffusion, Flux, Wan, HunyuanVideo 등 다양한 오픈소스 생성 모델을 코드 작성 없이 조합해 실행할 수 있다. 윈도우, 리눅스, 맥, 그리고 엔비디아·AMD·인텔·애플 실리콘 등 거의 모든 하드웨어에서 로컬로 돌아간다.
무엇을 하는 레포인가
- 무엇을: 이미지·영상·3D·음성·텍스트 생성 모델을 하나의 그래프(노드들이 선으로 이어진 작업 흐름도) 위에서 조립해 실행하는 창작 엔진이다.
- 어떻게: 각 기능(모델 불러오기, 인페인팅, 업스케일링, LoRA 적용 등)을 노드라는 상자로 만들고 이를 마우스로 연결해 워크플로우를 구성한다. 그래프에서 바뀐 부분만 다시 계산하는 방식으로 반복 작업 속도를 높인다.
- 결과: Stable Diffusion 1.5부터 SDXL, Flux.1, Flux.2, Qwen Image, Wan, HunyuanVideo 1.5 등 최신 오픈소스 모델을 기본 지원하며, 데스크톱 앱, 윈도우용 포터블 패키지, 수동 설치, 클라우드 버전으로 제공된다.
- 기타: 워크플로우를 JSON 파일로 저장하거나, 생성된 이미지 파일 자체에서 사용된 시드값까지 포함한 전체 작업 흐름을 복원할 수 있다. 기본적으로 오프라인으로 완전히 작동하며, `--disable-api-nodes` 옵션으로 유료 API 노드를 아예 끌 수 있다.
왜 중요한가
현재 가장 많이 쓰이는 오픈소스 이미지·영상 생성 AI 실행 도구 중 하나로, 코드를 몰라도 최신 생성 모델들을 직접 조합해 실험할 수 있게 해준다. 12만 개가 넘는 스타를 받을 만큼 개인 창작자부터 프로덕션 파이프라인까지 폭넓게 쓰인다.
이 레포의 용어
- 노드/그래프 인터페이스 · 작업을 상자(노드)로 표시하고 선으로 연결해 흐름을 만드는 시각적 프로그래밍 방식
- LoRA · 기존 AI 모델에 적은 용량의 추가 학습 데이터를 얹어 스타일이나 캐릭터를 바꾸는 경량 파인튜닝 기법
- VAE · 이미지를 압축된 형태(잠재 공간)로 바꾸거나 복원하는 데 쓰이는 신경망 구성요소
- 인페인팅/아웃페인팅 · 이미지의 일부를 지우고 다시 채우거나(인페인팅), 이미지 바깥 영역을 확장해 새로 그리는(아웃페인팅) 기능
- 양자화 모델 · 모델 내부 숫자의 정밀도를 낮춰 용량과 연산량을 줄인 모델
레포 원문 소개 (영문)
The most powerful and modular diffusion model GUI, api and backend with a graph/nodes interface.
GitHub에서 보기주목받는 레포
- vorssaint/vorssaint-utils메뉴바 아이콘 하나로 유료 맥 앱 열 개 값을 대신하는 오픈소스 도구
- Alishahryar1/free-claude-code코딩 AI 에이전트를 무료 모델 49곳에 자유롭게 연결해주는 로컬 프록시
- freestylefly/awesome-gpt-image-2GPT-Image2로 원하는 이미지를 정확히 뽑아내는 프롬프트 설계도 532개를 모아놓은 저장소
- block/buzz사람과 AI 에이전트가 같은 채팅방에서 함께 일하는 오픈소스 협업 플랫폼
- NousResearch/hermes-agentNous Research가 만든, 쓰면 쓸수록 스스로 똑똑해지는 AI 에이전트 Hermes
- virgiliojr94/book-to-skill기술서 PDF를 AI 에이전트가 언제든 펼쳐볼 수 있는 '스킬'로 바꿔주는 도구
- VoltAgent/awesome-agent-skillsAI 코딩 도구가 특정 작업을 '전문가처럼' 하도록 도와주는 매뉴얼 1000개 이상을 한곳에 모았다
- anthropics/claude-plugins-community누구나 만든 Claude 확장 기능을 한곳에 모아 설치하게 해주는 저장소