Qwen-Image-2.1

Qwen-Image-2.1은 Qwen 팀이 2026년 9월 20일에 공개한 오픈 웨이트 이미지 모델입니다. 생성과 편집을 하나의 모델에서 처리하고, 투명(RGBA) 이미지를 기본으로 출력하며, 참조 이미지를 최대 10장까지 받고, 7B 생성 트랜스포머로 2K 해상도까지 지원합니다. GoEnhance는 아직 2.1을 제공하지 않아서, 아래 콘솔은 여기서 쓸 수 있는 가장 최신 Qwen 모델인 Qwen Image 3을 엽니다.
이중 언어 포스터 타이포그래피
이중 언어 포스터 타이포그래피
이중 언어 포스터 타이포그래피
라벨이 읽히는 제품 사진
라벨이 읽히는 제품 사진
6컷 스토리보드
6컷 스토리보드
에디토리얼 인물 사진
에디토리얼 인물 사진
Qwen Image 3
프롬프트
예시 프롬프트
이 모델과 프롬프트가 채워진 GoEnhance 편집기를 엽니다.

GoEnhance의 Qwen Image로 만들 수 있는 것

글자가 무너지지 않는 포스터

영어나 중국어로 헤드라인, 날짜, 작은 안내 문구를 배치해도 글자 형태가 유지된 결과를 받습니다. 실제 문구가 들어가는 행사 포스터, 키 비주얼, SNS 커버에 적합합니다.

글자가 무너지지 않는 포스터

라벨이 읽히는 제품 사진

깔끔한 배경에 제품을 두고 부드러운 조명을 유지하면서 라벨을 또렷하게 남깁니다. 카탈로그 이미지, 상품 등록 사진, 패키지 시안에 쓸 수 있습니다.

라벨이 읽히는 제품 사진

여러 컷의 보드와 그리드

6컷 보드, 9분할 설명 그래픽, 디자인 시트를 요청하면 모든 칸이 같은 스타일로, 원하는 위치에 캡션이 붙어 나옵니다.

여러 컷의 보드와 그리드

피부와 빛이 자연스러운 인물 사진

자연스러운 피부 질감, 눈동자의 캐치라이트, 부드러운 창가 빛의 에디토리얼 인물 사진을 만들고, 얼굴은 그대로 둔 채 의상이나 구도만 바꿔 갈 수 있습니다.

피부와 빛이 자연스러운 인물 사진

Qwen-Image-2.1의 새로운 점

잘라낸 것이 아닌, 기본 투명 지원

64채널 RGBA 오토인코더(공간 압축 16배)를 갖춰 투명도가 후처리가 아니라 모델 자체에 들어 있습니다. 프롬프트로 투명 이미지를 만들고, 투명 레이어를 편집하고, 일반 사진에서 피사체를 뽑아낼 수 있습니다.

생성과 편집을 한 모델에서

텍스트 생성과 이미지 편집이 같은 파이프라인을 씁니다. 프롬프트로 시작하든, 바꿀 이미지를 건네든, 한 번의 요청에서 둘 다 하든 체크포인트를 바꿀 필요가 없습니다.

참조 이미지 최대 10장

한 번의 편집에 최대 열 장의 참조를 넣을 수 있습니다. 개별 인물 사진으로 단체 사진을 만들거나, 모델·옷·신발·가방·모자의 개별 컷으로 전체 착장을 구성할 수 있습니다.

바꿀 곳을 직접 지목

부분 편집은 원으로 표시하거나, 덧칠한 주석 또는 별도 마스크로 지정합니다. 사람과 제품의 동일성은 유지된 채 표시한 영역만 바뀝니다.

7B의 단순한 구조

생성 트랜스포머는 32층 단일 스트림 DiT에 7B 파라미터이고, 텍스트 인코더는 Qwen3-VL 8B입니다. 혼합 단위 어텐션과 프리픽스 KV 캐시 재사용 덕분에 프롬프트와 참조 이미지는 한 번만 인코딩해 이후 단계에서 재사용합니다.

기본 2K와 더 또렷한 글자

권장 크기는 정사각형 2048×2048부터 16:9의 2752×1536까지이며 기본 40스텝입니다. 글자 조판, 인물 조명, 세밀한 질감이 이전 Qwen-Image보다 좋아졌습니다.

Qwen-Image-2.1 직접 실행하기

01

가중치 받기

Qwen-Image-2.1은 오픈 웨이트입니다. Hugging Face(Qwen/Qwen-Image-2.1)나 ModelScope에서 내려받거나, ComfyUI용으로 정리된 Comfy-Org/Qwen-Image-2.1을 사용하세요.

02

실행 환경 고르기

Diffusers가 QwenImage21Pipeline으로 첫날부터 지원하고, ComfyUI에도 생성과 편집 워크플로가 기본 제공됩니다. 부하가 큰 작업에는 vLLM-Omni, SGLang, LightX2V가 프리픽스 캐시, 양자화, 멀티 GPU 추론을 더해 주며 AMD ROCm과 FlagOS 칩도 지원합니다.

03

프롬프트, 크기, 투명도

공식 프롬프트 재작성 체크포인트(생성은 PE-T2I, 편집은 PE-I2I)에서 시작하고 권장 2K 크기와 40스텝을 유지하세요. 투명한 결과가 필요하면 모델이 기대하는 RGBA 문구로 프롬프트를 시작하면 됩니다.

Qwen-Image-2.1과 GoEnhance의 Qwen Image 비교

항목Qwen-Image-2.1 (오픈 웨이트)Qwen Image 3 (GoEnhance에서 제공)
실행 위치직접 준비한 GPU 또는 스스로 구성한 클라우드 환경브라우저에서 바로, 설치 없음
투명 RGBA 출력기본 지원, 투명 레이어 편집 포함지원하지 않음
참조 이미지한 번의 편집에 최대 10장에디터에서 참조 이미지 지원
해상도기본 2K, 최대 2752×15361K 및 2K 출력
글자 표현영어와 중국어 조판이 향상이중 언어 텍스트와 정보량 많은 레이아웃에 강함
시작 방법가중치를 받고 실행 환경을 설치해 GPU를 직접 관리프롬프트를 쓰고 생성 누르기

Qwen-Image-2.1 자주 묻는 질문

Qwen-Image-2.1은 무엇인가요?

Qwen 팀이 공개한 오픈 웨이트 이미지 모델로, 텍스트 기반 생성과 이미지 편집을 하나의 모델에서 처리합니다. 생성 트랜스포머는 32층 단일 스트림 DiT에 7B 파라미터이며 투명 RGBA 이미지를 기본으로 출력합니다. 가중치는 2026년 9월 20일에 공개됐습니다.

GoEnhance에서 Qwen-Image-2.1을 쓸 수 있나요?

아직 아닙니다. GoEnhance에서는 Qwen Image 2, Qwen Image 2 Pro, Qwen Image 3, Qwen Image 3 Pro를 제공합니다. 이 페이지의 콘솔은 여기서 가장 최신인 Qwen Image 3을 열어 주므로, GPU를 따로 준비하지 않고도 같은 계열을 써 볼 수 있습니다.

상업적으로 무료인가요?

저장소는 Qwen Research License Agreement로 공개되어 있고, 이는 일반적인 상업용 라이선스와 다릅니다. 가중치나 결과물을 상업 프로젝트에 쓰기 전에 GitHub의 라이선스 전문을 확인하세요.

투명 이미지는 어떻게 만들어지나요?

투명도는 오토인코더에 들어 있습니다. 64채널 RGBA VAE에 공간 압축은 16배입니다. 프롬프트에서 배경이 투명한 RGBA 이미지라고 밝히면, 잘라낸 마스크가 아니라 실제 알파 채널이 있는 이미지를 받습니다.

어떤 하드웨어가 필요한가요?

생성 모델이 7B, 텍스트 인코더가 8B이므로 실질적으로는 VRAM이 넉넉한 최신 GPU가 출발점입니다. 커뮤니티 실행 환경도 도움이 됩니다. vLLM-Omni와 SGLang은 FP8 가중치, CPU 오프로딩, 멀티 GPU 병렬을 지원하고 LightX2V는 소비자용 그래픽카드를 겨냥합니다.

참조 이미지는 몇 장까지 되나요?

한 번의 편집에 최대 열 장입니다. 덕분에 여러 피사체를 한 장면에 넣거나, 따로 찍은 제품 사진으로 전체 착장을 구성하는 작업이 실용적이 되고, 각 요소도 알아볼 수 있게 유지됩니다.

GoEnhance에서 Qwen Image 제품군 써 보기

Qwen-Image-2.1은 오픈 웨이트 모델이라 직접 장비를 준비해 실행합니다. 프롬프트를 쓰고 결과 이미지를 바로 받고 싶다면, GoEnhance에서 Qwen Image 3을 열고 위 예시 중 하나로 시작해 보세요.

Qwen Image 3으로 시작하기