LTX-2.5 (modèle vidéo)
Tutoriel associéLTX-2.5 est un modèle de génération vidéo IA qui produit de courts clips vidéo à partir d'un prompt texte ou d'une image de départ. Il génère le mouvement, les mouvements de caméra et les détails visuels, et produit un son synchronisé pour correspondre à l'action à l'écran plutôt que de laisser le clip muet. Lightricks l'a publié avec des poids ouverts le 11 août 2026.
Les modèles vidéo comme celui-ci sont plus exigeants que les modèles image, car ils génèrent de nombreuses images consécutives qui doivent rester cohérentes entre elles.
Ce qu'a apporté la version 2.5
- Scènes multi-plans natifs. Le modèle peut rendre des plans enchaînés, large puis plan moyen puis gros plan, en une seule génération, en conservant le personnage, le décor, l'éclairage et la voix cohérents d'un plan à l'autre.
- Un nouveau décodeur vidéo par diffusion, qui réduit les artefacts que les versions précédentes produisaient dans les scènes à fort mouvement.
- Un encodeur de texte Gemma 4 12B affiné avec un rehausseur de prompt dédié, pour que les prompts complexes avec plusieurs sujets soient compris à partir d'instructions plus courtes.
- Durée automatique, la longueur du clip étant déduite de l'action décrite plutôt que définie manuellement.
- 4K HDR natif, la plage dynamique élevée faisant partie du pipeline plutôt qu'étant un post-traitement.
Dans tendre.AI, LTX alimente toute la génération vidéo, en deux versions : Turbo pour des brouillons rapides et légers, et Full pour le clip final de meilleure qualité. L'une comme l'autre se rend localement sur ton propre GPU NVIDIA gratuitement, ou dans le cloud avec des crédits quand tu as besoin de plus de puissance ou que tu n'as pas de carte compatible. Le son est généré nativement en même temps que l'image, synchronisé avec l'action.