AIbaseMis à jour le

Vidu Q4 preview version publiée par Shengshu Technology, compatible avec la sortie 4K

La société Shénshù Keji a publié une version préliminaire du modèle phare de génération de vidéos Vidu Q4Preview de nouvelle génération. Elle présente des améliorations notables en termes de qualité de génération, de…

Récemment, Sengshu Technology a officiellement déployé la version préliminaire du modèle phare de génération de vidéo de nouvelle génération, Vidu Q4Preview. Cette mise à jour présente des améliorations significatives en termes de qualité de génération, de référence multimodale et d’exactitude de l’image, marquant ainsi une étape cruciale pour les grands modèles de vidéo locaux qui s’apprêtent à atteindre une qualité comparable à celle du cinéma.

En termes de fonctionnalités essentielles, Vidu Q4Preview prend en charge pleinement les deux modes principaux : l’image à vidéo et la vidéo basée sur des références. Le mode image à vidéo permet de générer des images de haute qualité en se basant sur les photos et les descriptions textuelles fournies par l’utilisateur ; tandis que le mode vidéo basé sur des références permet de créer une vidéo en combinant plusieurs images de référence et du son, ce qui enrichit considérablement les moyens de contrôle des créateurs.

Cette mise à jour a réalisé une avancée majeure en matière de capacité de référence multimodale et de contrôle des détails. Le modèle permet au maximum l’entrée de 3 segments d’audio de référence, permettant ainsi que le timbre des personnages reste hautement cohérent dans la vidéo grâce à une référence sonore précise ; en même temps, il supporte au maximum 15 images de référence, offrant ainsi des fondements visuels plus complets pour les caractéristiques du visage des personnages, les scènes complexes et les éléments créatifs tels que les objets, afin de garantir l’unité des éléments dans les plans longs et la narration continue.

En termes de qualité d’image et de représentation des plans, Vidu Q4Preview a encore amélioré les mouvements dynamiques, les transitions entre plans et la liaison des plans complexes, ce qui a entraîné une amélioration significative de la fluidité de l’image et de la tension dramatique. En ce qui concerne les spécifications, il supporte jusqu’à des résolutions 2K et 4K, avec une profondeur de couleur de 10 bits, et peut générer jusqu’à 16 secondes de vidéo par émission, ce qui correspond parfaitement aux applications diverses telles que les séries courtes basées sur l’IA, les publicités marketing, les interactions sociales et la création professionnelle de films.

De plus, l’éditeur officiel a introduit des modèles de spécifications et de tarifs flexibles en fonction des différentes étapes de création. Ce modèle prend en charge plusieurs résolutions telles que 540P, 720P, 1080P, 2K et 4K, et propose une offre de lancement à partir de 0,09 yuans par seconde. Les créateurs peuvent d’abord utiliser des versions à faible résolution pour les tests, les scripts et les plans, puis, une fois leur idée mûre, produire directement des films finaux à haute résolution 2K ou 4K, avec une texture délicate et des éclairages impressionnants.

Source originale

AIbase

À propos du contenu

La publication originale et les droits appartiennent à la source.

Traduction automatique · Consultez l’original