LTX-2.5: Het Audio- en Videomodel in tendre.AI

26 juni 2026

LTX-2.5 is het audio- en videogeneratiemodel dat video in tendre.AI aandrijft. Het maakt deel uit van de LTX-familie van video-diffusiemodellen en het kenmerkende is dat het beeld en geluid samen genereert, in één model, in plaats van een stille clip te maken en audio over te laten aan een apart hulpmiddel. Dit artikel geeft een begrijpelijke technische uitleg over hoe het werkt en hoe tendre.AI het integreert.

Waarom een gecombineerd audio-videomodel ertoe doet

De oude manier om een clip met geluid te krijgen was een pipeline: een videomodel maakt de frames, een audiomodel maakt een track, en je lijnt ze handmatig op. Het probleem is die uitlijning. Geluid dat gegenereerd is zonder de beweging te "zien" klopt nooit precies: een voetstap een halve tel te laat, een stem die niet bij de mond past, omgevingsgeluid dat de scène negeert.

LTX-2.5 maakt die pipeline overbodig. Omdat hetzelfde model zowel de frames als het audio produceert, zijn de twee van nature samenhangend: de soundtrack is geconditioneerd op dezelfde inhoud als het beeld, zodat beweging en geluid gesynchroniseerd zijn vanaf de eerste generatie, niet achteraf geplakt.

De architectuur, in gewone woorden

LTX-2.5 is een diffusion transformer (DiT). Twee ideeën die de moeite waard zijn om te begrijpen:

  • Diffusie betekent dat het model begint vanuit ruis en stap voor stap denoise totdat een clip ontstaat die overeenkomt met je prompt. Het is hetzelfde principe als achter moderne beeldmodellen zoals SDXL, uitgebreid naar tijd.
  • Transformer betekent dat het aandacht besteedt aan de volledige reeks (over frames heen, en over de audiostream) in plaats van elk frame onafhankelijk te behandelen. Dat globale overzicht is wat beweging stabiel houdt en audio vergrendeld aan de actie gedurende de lengte van de clip.

Werken over de volledige clip tegelijk, in plaats van frame voor frame, is de kernoorzaak waarom de uitvoer samenhangend blijft: objecten behouden hun vorm, de camerabeweging blijft vloeiend, en het geluid volgt het beeld.

Text-to-video en image-to-video

LTX-2.5 ondersteunt twee ingangspunten, en tendre.AI gebruikt beide:

  • Text-to-video: beschrijf de shot, krijg een clip met geluid.
  • Image-to-video: begin vanuit een stilstaand beeld dat je al lokaal hebt gegenereerd in tendre.AI en animeer het. Het eerste frame is jouw afbeelding, zodat het personage en de stijl die je hebt vastgelegd (met een LoRA of een vaste seed) direct meegaan naar de video.

Image-to-video is wat de workflow "één tool voor afbeelding en video" werkelijk maakt: de foto die je mooi vindt wordt het openingsframe van de clip, zelfde gezicht, zelfde look.

Resolutie: 1080p voor iteratie, 4K voor eindresultaten

Hetzelfde model richt zich op meerdere resoluties. In de praktijk geeft dat een overzichtelijke workflow:

  • 1080p (Full HD) voor iteratie: snel genoeg om een prompt te proberen, het resultaat te horen, aan te passen en opnieuw te draaien.
  • 4K (Ultra HD) voor definitieve renders: vier keer zoveel pixels, voor grote schermen of ruimte om bij te snijden en te stabiliseren in nabewerking.

Je maakt een schets in 1080p, vergrendelt de shot (beweging, kadering, audio), en maakt de uiteindelijke versie in 4K af, zonder van engine te wisselen tussen schets en oplevering.

Efficiëntie is het punt

De LTX-lijn staat bekend als snel voor zijn kwaliteit. Die efficiëntie is geen ijdele statistiek: het is wat snelle 1080p-schetsen en 4K-finals op aanvraag praktisch maakt in plaats van nachtelijke klussen. Een model dat efficiënt genoeg is om mee te itereren verandert hoe je werkt, je verkent meer takes omdat elke take weinig tijd kost.

Wat versie 2.5 gebracht heeft

Lightricks bracht LTX-2.5 met open gewichten uit op 11 augustus 2026. Vier veranderingen zijn van belang voor iedereen die daadwerkelijk clips genereert.

Meerdere shots in één scène. Het model kan verbonden shots renderen, van wijd naar medium naar close-up, in één generatie, terwijl het personage, de omgeving, de belichting en de stem stabiel blijven over de snijpunten. Voorheen betekende een reeks elke shot apart renderen en hopen dat het gezicht en het licht overeen kwamen. Dit is de verandering die een clip in een scène verandert.

Een nieuwe diffusion video decoder. De meest zichtbare winst bij gewone beelden: minder artefacten in scènes met veel beweging, precies waar eerdere versies wazig werden. Een hoofd dat snel draait, een snelle pan, bewegend haar, alles blijft beter bij elkaar, terwijl de hoge compressieverhouding waarop de LTX-familie vertrouwt behouden blijft.

Een betere tekstencoder. Promptverwerking verhuisde naar een fijnafgestemde Gemma 4 12B-encoder gecombineerd met een speciale prompt-verbeteraar. In de praktijk leest het complexe, meervoudige instructies uit kortere prompts, zodat je minder tijd kwijt bent aan overspecificatie.

Automatische duur. De cliplengte wordt afgeleid uit de actie die je beschrijft in plaats van handmatig in frames in te stellen, en native 4K HDR maakt nu deel uit van de pipeline in plaats van een nabewerking.

Ter referentie: op datacenter-hardware rendert LTX-2.5 10 seconden 720p in minder dan 7 seconden. Dat getal is wat cloud-rendering die per clip wordt gefactureerd überhaupt haalbaar maakt.

Dit zijn mogelijkheden van de engine. Ze komen progressief in tendre.AI terecht, release na release. De changelog is de referentie voor wat actief is in de versie die je gebruikt.

Hoe tendre.AI LTX-2.5 integreert

tendre.AI past zijn gebruikelijke regel toe: lokaal eerst, cloud alleen voor het zware werk dat je zelf kiest.

  • Afbeeldingen blijven 100% lokaal. Elk stilstaand beeld wordt gegenereerd op jouw eigen GPU, niets wordt geüpload.
  • LTX-2.5 video draait op een cloud-GPU, op aanvraag. Gesynchroniseerd audio en zeker 4K zijn rekenintensief, dus ze draaien op een externe GPU en worden per clip gefactureerd in credits. Het is opt-in: als je alleen afbeeldingen genereert, verandert er niets aan je privé lokale workflow.
  • Dezelfde personages in beide. Omdat video begint vanuit je lokale stilstaande beelden, gaat de identiteit die je hebt opgebouwd mee naar de clip.

Migratienotitie: tendre.AI rolt LTX-2.5 actief uit in de app. Video met geluid, 1080p-iteratie en 4K-afwerking komen progressief beschikbaar naarmate de migratie voltooit. De lokale beeldworkflow wordt niet beïnvloed.

De inhoudgrens geldt nog steeds

LTX-2.5 verandert niets aan de strikte regel van tendre.AI. Alles wat gegenereerd wordt is 100% synthetisch: er wordt geen echte persoon afgebeeld, en elk onderwerp is onmiskenbaar een volwassene. Het model is een hulpmiddel voor fictieve, volwassen, AI-gegenereerde inhoud, niets anders.

Genereer video met geluid in tendre.AI

LTX-2.5 brengt gesynchroniseerd audio en video, in 1080p en 4K, bovenop een 100% lokale beeldworkflow. Één tool voor afbeelding en video, geen abonnement.

AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Cyberpunk Universe)AI-generated portrait by tendre.AI (Fantasy Universe)AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Library)AI-generated portrait by tendre.AI (At work)AI-generated portrait by tendre.AI (FarWest)AI-generated portrait by tendre.AI (Cyberpunk UNIVERSE)AI-generated portrait by tendre.AI (Exterior)
Windows · Cloud of NVIDIA

Genereer privé. Vanavond.

Download tendre.AI, activeer één keer en gebruik het voor altijd, volledig offline, op je eigen GPU.

Downloaden voor WindowsDownload voor Android (.apk)
Downloaden voor MacMac-versie komt binnenkort!
OS Windows 10/11GPU NVIDIA 8GB+VRAM 12GB aanbevolenSchijf 20GB

Geen NVIDIA GPU? Begin 100% in de cloud: elke dag 10 gratis afbeeldingen, daarna 1 credit per afbeelding. Een NVIDIA-kaart (8GB+) ontgrendelt onbeperkte lokale generatie.