Wo Qwen-Image-2.1 im Text to Image am stärksten ist: unter allen Modellen am nächsten an der Kategorien-Grenze in Lighting, Knowledge und Reasoning
Unsere Text to Image-Taxonomie misst 9 Fähigkeiten und 10 Anwendungsfälle, jeweils mit eigener Rangliste. Fähigkeiten sind die einzelnen Fertigkeiten, die in die Erzeugung eines Bildes einfließen.
Qwen-Image-2.1 ist in Lighting der Kategorien-Grenze am nächsten, gefolgt von Knowledge, Reasoning und Layout. Gegenüber Qwen Image 2.0 verkleinert es den Abstand zur Grenze bei jeder Fähigkeit, mit den größten Zuwächsen bei Layout, Lighting und Knowledge.
➤ Lighting umfasst Reflexion, Brechung, Schatten und Kaustiken.
➤ Knowledge umfasst echte Wahrzeichen, Arten und Fachwissen in Naturwissenschaft und Alltagswissen.
➤ Reasoning umfasst das Interpretieren von Redewendungen, Mathematik und Naturwissenschaft, räumliches und zeitliches Denken sowie das Kombinieren von Konzepten.




