Qwen-Image-2.1이 Text to Image에서 가장 강력한 분야: Lighting, Knowledge, Reasoning에서 전체 모델 중 해당 카테고리 프론티어에 가장 근접
우리의 Text to Image 분류 체계는 9개의 역량과 10개의 사용 사례를 측정하며, 각각 자체 리더보드를 갖습니다. 역량은 이미지를 만드는 데 들어가는 개별 기술입니다.
Qwen-Image-2.1은 Lighting에서 카테고리 프론티어에 가장 근접하며, 그 뒤를 Knowledge, Reasoning, Layout이 따릅니다. Qwen Image 2.0 대비 모든 역량에서 프론티어와의 격차를 줄였으며, Layout, Lighting, Knowledge에서 가장 큰 향상을 보였습니다.
➤ Lighting은 반사, 굴절, 그림자, 그리고 휘광을 다룹니다.
➤ Knowledge는 실제 랜드마크, 종, 그리고 과학과 상식 전반의 도메인 사실을 다룹니다.
➤ Reasoning은 관용구 해석, 수학과 과학, 공간 및 시간 추론, 그리고 개념 혼합을 다룹니다.




