Dónde es más fuerte Qwen-Image-2.1 en Text to Image: más cerca de la frontera de la categoría entre todos los modelos en Lighting, Knowledge y Reasoning
Nuestra taxonomía de Text to Image mide 9 capacidades y 10 casos de uso, cada uno con su propia tabla de clasificación. Las capacidades son las habilidades individuales que intervienen en la creación de una imagen.
Qwen-Image-2.1 está más cerca de la frontera de la categoría en Lighting, seguido de Knowledge, Reasoning y Layout. Frente a Qwen Image 2.0 reduce la distancia a la frontera en cada capacidad, con las mayores ganancias en Layout, Lighting y Knowledge.
➤ Lighting abarca la reflexión, la refracción, las sombras y las cáusticas.
➤ Knowledge abarca monumentos reales, especies y hechos de dominio en ciencia y sentido común.
➤ Reasoning abarca la interpretación de modismos, las matemáticas y las ciencias, el razonamiento espacial y temporal, y la mezcla de conceptos.




