Qwen Image 2.1 출시: ComfyUI에서 7B 초경량 고화질 이미지 생성 및 편집 완벽 가이드
Qwen Image 2.1은 7B(70억 개 파라미터) 수준의 가벼운 아키텍처이면서도 고화질 이미지 생성(Text-to-Image)과 참조 이미지를 활용한 이미지 편집(Image-to-Image / Inpainting)을 단일 모델로 지원하는 모델입니다. ComfyUI 최신 환경에서 모델 파일을 배치하고 워크플로우를 세팅하는 핵심 방법을 정리합니다.
[Flowchart] Qwen Image 2.1 이미지 생성 및 편집 프로세스
[ComfyUI 최신 업데이트] ➔ [Diffusion / Text Encoder / VAE 모델 배치] ➔ [노드 구성 (텍스트 프롬프트 / 참조 이미지 연결)] ➔ [Sampler(CFG, Steps) 설정] ➔ [고화질 결과물 생성]
ComfyUI 기반 Qwen Image 2.1 파이프라인 흐름
1. 필수 모델 다운로드 및 저장 경로
원활한 노드 인식 및 호환성을 위해 사전에 ComfyUI를 최신 버전으로 업데이트해야 합니다. 각 모델 파일은 사양에 맞춰 다운로드 후 정해진 디렉터리에 배치합니다.
| 구분 |
추천 모델 파일 및 포맷 |
저장 경로 |
비고 |
| Diffusion Model |
Qwen Image 2.1 (BF16: 약 14GB / INT8: 약 7GB) |
ComfyUI/models/diffusion_models/ |
VRAM 여유에 따라 선택 (일반 환경은 INT8 권장) |
| Text Encoder |
Qwen2.5-VL 8B (INT8 또는 적정 규격) |
ComfyUI/models/text_encoders/ |
텍스트 인코딩 및 멀티모달 입력 처리 |
| VAE Model |
Qwen Image 2.1 VAE (BF16) |
ComfyUI/models/vae/ |
경량화 없이 기본 BF16 파일 사용 |
2. 텍스트 투 이미지(Text-to-Image) 워크플로우 설정
[Diagram] Text-to-Image 표준 노드 연결도
[Diffusion Loader + Text Encoder Loader + VAE Loader] ➔ [Text Encoder Qwen Image 2.1 (Prompt)] ➔ [Resolution Selector] ➔ [KSampler] ➔ [VAE Decode] ➔ [Save Image]
단일 텍스트 프롬프트 기반 생성 구조
- 프롬프트 노드: 최신 ComfyUI 전용 노드인
Text Encoder Qwen Image 2.1 노드를 사용합니다.
- 해상도 설정 (Resolution Selector):
- 일반 이미지: 비율 16:9, Megapixels 1.0 설정
- 인물 전신/캐릭터 시트: 전신 컷에서 얼굴 디테일 뭉개짐을 방지하기 위해 Megapixels 2.0 이상 권장
- 샘플러 파라미터 (KSampler):
- Steps: 25 단계
- CFG: 1.0 (CFG가 1.0일 경우 네거티브 프롬프트가 반영되지 않으므로, 네거티브 프롬프트 적용이 필요하다면 CFG 값을 올려서 설정)
- 텍스트 렌더링 특성: 영어와 중국어 텍스트 표기 능력이 우수하며, 짧고 단순한 한글 텍스트도 렌더링되나 문장이 길어지거나 글자 크기가 작아지면 왜곡이 발생할 수 있습니다.
3. 이미지 편집(Image Edit) 및 다중 참조 합성 워크플로우
참조 이미지를 입력받아 특정 인물에 새로운 의상이나 소품을 자연스럽게 합성하는 편집 파이프라인입니다.
[Flowchart] 이미지 편집 및 다중 참조 합성 파이프라인
[참조 이미지 입력 (인물, 의상, 가방 등 최대 10개)] ➔ [Text Encoder 노드 결합] ➔ [Qwen Image 2.1 Cache 노드 (메모리 유지)] ➔ [Switch 노드 (사이즈/비율 제어)] ➔ [조화로운 단일 컷 합성 생성]
참조 이미지 아이덴티티를 유지하며 결합하는 편집 구조
핵심 전용 노드 및 기능
| 노드/기능명 |
동작 방식 및 세부 설정 |
| 다중 이미지 입력 |
텍스트 인코더 노드에 이미지 노드를 순차 연결하며, 최대 10개까지 참조 이미지 추가 가능 |
| Switch 노드 |
True: 사용자가 설정한 별도 해상도로 생성
False: 원본 참조 이미지의 화면 비율 기준으로 생성 |
| Qwen Image 2.1 Cache |
샘플링 진행 동안 프롬프트와 참조 이미지 정보를 메모리에 유지해 합성 일관성 확보 |

4. 실전 활용 팁
- 다중 사물 합성: 인물 이미지에 드레스, 가방, 액세서리 등을 개별 참조로 연결해도 고유 디자인과 인물 특징을 유지하며 자연스러운 조명·배경으로 일체화됩니다.
- 다양한 응용 분야: 단일 인물 합성을 넘어 여러 인물을 합친 가족사진 제작이나 가구 소품을 배치한 인테리어 컨셉 컷 생성에 활용하기 적합합니다.
- VRAM 관리: GPU 메모리가 부족한 경우 Diffusion 모델과 Text Encoder를 모두 INT8 양자화 버전으로 세팅하면 쾌적한 속도로 작업할 수 있습니다.
결론
Qwen Image 2.1은 7B급의 가벼운 용량으로 고품질 피부 질감과 디테일을 구현하며, 단일 워크플로우 안에서 최대 10개 참조 이미지 합성까지 지원하는 높은 범용성을 갖춘 모델입니다.
댓글목록
등록된 댓글이 없습니다.