알리바바 Qwen팀이 이미지 생성·편집 오픈웨이트 모델 Qwen-Image-2.1을 공개했다. 시각 생성 컴포넌트 파라미터 수는 70억(7B)에 불과하지만, 팀 자체 벤치마크에서 대부분의 클로즈드 모델을 앞선다고 밝혔다. 독립 기관의 검증은 아직 진행 중이다.
주요 기능 5가지
| 기능 | 설명 |
|---|---|
| 투명 이미지 처리 | RGBA 형식 네이티브 지원 — 투명 레이어 오브젝트 분리·텍스트 변경 가능 |
| 다중 레퍼런스 | 최대 10장 참조 이미지 동시 처리 (단체 사진 합성, 가상 피팅, 인테리어 등) |
| 로컬 편집 | 원형·마스크·페인트 마크로 특정 영역만 지정 편집 |
| 추론 속도 | 아키텍처 변경 + KV 캐시 재사용으로 다중 레퍼런스 처리 시 속도 향상 |
| 구동 환경 | RTX 3090급 소비자용 GPU에서 실행 가능 |
접근 경로 및 라이선스
Hugging Face·GitHub·ModelScope에서 내려받을 수 있으며 Hugging Face 데모도 제공된다. 다만 리서치 라이선스 조건으로 상업적 사용은 금지된다. 기업 사용자는 Qwen에 별도 라이선스를 신청해야 한다.
국내 이미지 생성 모델을 개발하는 스타트업이나 연구팀에는 7B 규모로 클로즈드 모델 수준 성능을 달성한 설계 방식이 경량화 전략의 참고 사례가 될 수 있다.








