본문 바로가기

Comfy UI

Image ComfyUI에서 7B 초경량 고화질 이미지 생성 및 편집

페이지 정보

작성자 이노힐
댓글 0건 조회 10회
작성일 2026-09-25 19:46:01

본문

Qwen Image 2.1 출시: ComfyUI에서 7B 초경량 고화질 이미지 생성 및 편집 완벽 가이드

Qwen Image 2.1은 7B(70억 개 파라미터) 수준의 가벼운 아키텍처이면서도 고화질 이미지 생성(Text-to-Image)과 참조 이미지를 활용한 이미지 편집(Image-to-Image / Inpainting)을 단일 모델로 지원하는 모델입니다. ComfyUI 최신 환경에서 모델 파일을 배치하고 워크플로우를 세팅하는 핵심 방법을 정리합니다.

[Flowchart] Qwen Image 2.1 이미지 생성 및 편집 프로세스
[ComfyUI 최신 업데이트] ➔ [Diffusion / Text Encoder / VAE 모델 배치] ➔ [노드 구성 (텍스트 프롬프트 / 참조 이미지 연결)] ➔ [Sampler(CFG, Steps) 설정] ➔ [고화질 결과물 생성]
ComfyUI 기반 Qwen Image 2.1 파이프라인 흐름

1. 필수 모델 다운로드 및 저장 경로

원활한 노드 인식 및 호환성을 위해 사전에 ComfyUI를 최신 버전으로 업데이트해야 합니다. 각 모델 파일은 사양에 맞춰 다운로드 후 정해진 디렉터리에 배치합니다.

구분 추천 모델 파일 및 포맷 저장 경로 비고
Diffusion Model Qwen Image 2.1 (BF16: 약 14GB / INT8: 약 7GB) ComfyUI/models/diffusion_models/ VRAM 여유에 따라 선택 (일반 환경은 INT8 권장)
Text Encoder Qwen2.5-VL 8B (INT8 또는 적정 규격) ComfyUI/models/text_encoders/ 텍스트 인코딩 및 멀티모달 입력 처리
VAE Model Qwen Image 2.1 VAE (BF16) ComfyUI/models/vae/ 경량화 없이 기본 BF16 파일 사용

2. 텍스트 투 이미지(Text-to-Image) 워크플로우 설정

[Diagram] Text-to-Image 표준 노드 연결도
[Diffusion Loader + Text Encoder Loader + VAE Loader] ➔ [Text Encoder Qwen Image 2.1 (Prompt)] ➔ [Resolution Selector] ➔ [KSampler] ➔ [VAE Decode] ➔ [Save Image]
단일 텍스트 프롬프트 기반 생성 구조
  • 프롬프트 노드: 최신 ComfyUI 전용 노드인 Text Encoder Qwen Image 2.1 노드를 사용합니다.
  • 해상도 설정 (Resolution Selector):
    • 일반 이미지: 비율 16:9, Megapixels 1.0 설정
    • 인물 전신/캐릭터 시트: 전신 컷에서 얼굴 디테일 뭉개짐을 방지하기 위해 Megapixels 2.0 이상 권장
  • 샘플러 파라미터 (KSampler):
    • Steps: 25 단계
    • CFG: 1.0 (CFG가 1.0일 경우 네거티브 프롬프트가 반영되지 않으므로, 네거티브 프롬프트 적용이 필요하다면 CFG 값을 올려서 설정)
  • 텍스트 렌더링 특성: 영어와 중국어 텍스트 표기 능력이 우수하며, 짧고 단순한 한글 텍스트도 렌더링되나 문장이 길어지거나 글자 크기가 작아지면 왜곡이 발생할 수 있습니다.

3. 이미지 편집(Image Edit) 및 다중 참조 합성 워크플로우

참조 이미지를 입력받아 특정 인물에 새로운 의상이나 소품을 자연스럽게 합성하는 편집 파이프라인입니다.

[Flowchart] 이미지 편집 및 다중 참조 합성 파이프라인
[참조 이미지 입력 (인물, 의상, 가방 등 최대 10개)] ➔ [Text Encoder 노드 결합] ➔ [Qwen Image 2.1 Cache 노드 (메모리 유지)] ➔ [Switch 노드 (사이즈/비율 제어)] ➔ [조화로운 단일 컷 합성 생성]
참조 이미지 아이덴티티를 유지하며 결합하는 편집 구조

핵심 전용 노드 및 기능

노드/기능명 동작 방식 및 세부 설정
다중 이미지 입력 텍스트 인코더 노드에 이미지 노드를 순차 연결하며, 최대 10개까지 참조 이미지 추가 가능
Switch 노드 True: 사용자가 설정한 별도 해상도로 생성
False: 원본 참조 이미지의 화면 비율 기준으로 생성
Qwen Image 2.1 Cache 샘플링 진행 동안 프롬프트와 참조 이미지 정보를 메모리에 유지해 합성 일관성 확보

4. 실전 활용 팁

  • 다중 사물 합성: 인물 이미지에 드레스, 가방, 액세서리 등을 개별 참조로 연결해도 고유 디자인과 인물 특징을 유지하며 자연스러운 조명·배경으로 일체화됩니다.
  • 다양한 응용 분야: 단일 인물 합성을 넘어 여러 인물을 합친 가족사진 제작이나 가구 소품을 배치한 인테리어 컨셉 컷 생성에 활용하기 적합합니다.
  • VRAM 관리: GPU 메모리가 부족한 경우 Diffusion 모델과 Text Encoder를 모두 INT8 양자화 버전으로 세팅하면 쾌적한 속도로 작업할 수 있습니다.

결론

Qwen Image 2.1은 7B급의 가벼운 용량으로 고품질 피부 질감과 디테일을 구현하며, 단일 워크플로우 안에서 최대 10개 참조 이미지 합성까지 지원하는 높은 범용성을 갖춘 모델입니다.

댓글목록

등록된 댓글이 없습니다.

댓글쓰기

내용

방문자 집계

  • 오늘 518
  • 어제 1,185
  • 최대 10,182
  • 전체 270,628

Copyright © innohealonline.com. All rights reserved.