LTX-2.5 (model wideo)
Related tutorialLTX-2.5 to model AI do generowania wideo, który tworzy krótkie klipy wideo na podstawie promptu tekstowego lub obrazu startowego. Generuje ruch, ruch kamery i szczegóły wizualne, a także produkuje zsynchronizowany dźwięk pasujący do akcji na ekranie, zamiast pozostawiać klip bez dźwięku. Lightricks udostępnił go z otwartymi wagami 11 sierpnia 2026 roku.
Modele wideo takie jak ten są bardziej wymagające niż modele obrazu, ponieważ generują wiele kolejnych klatek, które muszą pozostać ze sobą spójne.
Co dodała wersja 2.5
- Natywne sceny wieloujęciowe. Model potrafi renderować połączone ujęcia, szerokie, a potem średnie i zbliżenie, w jednej generacji, zachowując spójność postaci, miejsca, oświetlenia i głosu we wszystkich cięciach.
- Nowy dyfuzyjny dekoder wideo, który eliminuje artefakty pojawiające się we wcześniejszych wersjach w scenach z dużym ruchem.
- Dopracowany enkoder tekstu Gemma 4 12B z dedykowanym wzmacniaczem promptów, dzięki czemu złożone prompty z kilkoma podmiotami są rozumiane na podstawie krótszych instrukcji.
- Automatyczny czas trwania, czyli długość klipu jest wnioskowana z opisanej akcji, zamiast być ustawiana ręcznie.
- Natywne 4K HDR, wysoki zakres dynamiczny będący częścią procesu, a nie efektem końcowej obróbki.
W tendre.AI LTX napędza całe generowanie wideo w dwóch wersjach: Turbo do szybkich, lżejszych szkiców oraz Full do gotowego klipu o wyższej jakości. Każda z nich renderuje lokalnie na twoim własnym GPU NVIDIA za darmo lub w chmurze na kredytach, gdy potrzebujesz większej mocy albo nie masz kompatybilnej karty. Dźwięk jest generowany natywnie razem z obrazem, zsynchronizowany z akcją.