Wir starten AA-Video-T2V v2.0, unseren neuen Benchmark zur Bewertung von Text-zu-Video-Modellen, gemeinsam mit AA-Video-T2V-Silent v2.0 für Videoerzeugung ohne Audio. Basierend auf einer neuen Methodik bewertet er jedes Modell bei 1080p auf einem regelmäßig aktualisierten Prompt-Satz und rankt sie über 10 Anwendungsfälle, 10 Fähigkeiten und eine breite Palette von Stilen. Videomodelle werden in immer mehr Branchen und Workflows eingesetzt, von Filmstudios bis zu Werbeagenturen. Unser neuer Benchmark rankt Modelle nicht nur insgesamt, sondern zeigt auch, welches Modell für bestimmten Anwendungsfall und bestimmte Videoerzeugungsfähigkeit am besten geeignet ist. Anwendungsfälle basieren darauf, wie Verbraucher und Unternehmen Videoerzeugung nutzen. Fähigkeiten stützen sich auf Labor- und akademische Forschung sowie darauf, wie Kreative und Unternehmen Videomodelle heute an ihre Grenzen bringen. Wir versehen jeden Prompt mit Tags zum Anwendungsfall (wie Live-Action-Film und Marketing & Advertising) und zur getesteten Fähigkeit (wie Text Rendering und Audio Synchronization), und der Gesamtbenchmark sampelt gleichmäßig über beide. Dadurch spiegelt das Gesamtranking die Vielseitigkeit eines Modells über Anwendungsfälle und seine Rundum-Fähigkeiten über Fähigkeiten hinweg wider. Wir versehen jeden Prompt auch mit Tags zum visuellen Stil, wie fotorealistisch, 3D-Rende