LTX-2.5: Lyd- og videomodellen i tendre.AI

26. juni 2026

LTX-2.5 er modellen for lyd- og videogenerering som driver video i tendre.AI. Den tilhører LTX-familien av videodiffusjonsmodeller, og det som skiller den ut er at den genererer bilde og lyd samtidig, i én og samme modell, i stedet for å lage et lydløst klipp og overlate lyden til et separat verktøy. Denne artikkelen er en lettlest teknisk gjennomgang av hvordan den fungerer, og hvordan tendre.AI integrerer den.

Hvorfor en felles lyd- og videomodell er viktig

Den gamle måten å få et klipp med lyd på var en pipeline: en videomodell lager bildene, en lydmodell lager sporet, og du synkroniserer dem for hånd. Problemet er nettopp synkroniseringen. Lyd som er generert uten å "se" bevegelsen treffer aldri helt: et fottrinn en halv takt for sent, en stemme som ikke matcher munnen, bakgrunnslyd som ignorerer scenen.

LTX-2.5 fjerner den pipelinen. Fordi samme modell produserer bildene og lyden, er de to sammenhengende fra starten: lydsporet er betinget av det samme innholdet som bildet, slik at bevegelse og lyd er synkronisert fra første generering, ikke lappet på etterpå.

Arkitekturen, forklart på vanlig norsk

LTX-2.5 er en diffusjonstransformer (DiT). To ideer er verdt å forstå:

  • Diffusjon betyr at modellen starter fra støy og fjerner støy steg for steg mot et klipp som matcher prompten din. Det er det samme prinsippet som ligger bak moderne bildemodeller som SDXL, utvidet til tid.
  • Transformer betyr at den ser på hele sekvensen (på tvers av bilder og lydsporet) i stedet for å behandle hvert bilde uavhengig. Det globale blikket er det som holder bevegelsen stabil og lyden låst til handlingen gjennom hele klippet.

Å jobbe over hele klippet på én gang, i stedet for bilde for bilde, er kjerneårsaken til at resultatet forblir sammenhengende: objekter beholder formen sin, kamerabevegelsen forblir jevn, og lyden følger bildet.

Tekst-til-video og bilde-til-video

LTX-2.5 støtter to inngangspunkter, og tendre.AI bruker begge:

  • Tekst-til-video: beskriv scenen, få et klipp med lyd.
  • Bilde-til-video: start fra et stillbilde du allerede har generert lokalt i tendre.AI og animer det. Det første bildet er ditt eget, slik at karakteren og stilen du låste inn (med en LoRA eller et fast seed) føres direkte over i videoen.

Bilde-til-video er det som gjør «ett verktøy for bilde og video»-arbeidsflyten reell: bildet du er fornøyd med blir åpningsbildet i klippet, samme ansikt, samme uttrykk.

Oppløsning: 1080p for utprøving, 4K for ferdige klipp

Samme modell støtter flere oppløsninger. I praksis gir det en ryddig arbeidsflyt:

  • 1080p (Full HD) for utprøving: raskt nok til å prøve en prompt, høre resultatet, justere og kjøre igjen.
  • 4K (Ultra HD) for ferdige renders: fire ganger så mange piksler, for store skjermer eller rom til å beskjære og stabilisere i etterarbeidet.

Du utkaster på 1080p, låser scenen (bevegelse, innramming, lyd), og avslutter med 4K, uten å bytte motor mellom utkast og levering.

Effektivitet er poenget

LTX-serien er kjent for å være rask i forhold til kvaliteten. Den effektiviteten er ikke bare et tall på papiret: det er det som gjør raske 1080p-utkast og 4K-finals på forespørsel praktisk i stedet for over-natten-jobber. En modell som er effektiv nok til å iterere med, endrer måten du jobber på. Du utforsker flere varianter fordi hver enkelt koster lite i tid.

Hva versjon 2.5 brakte med seg

Lightricks slapp LTX-2.5 med åpne vekter 11. august 2026. Fire av endringene er viktige for alle som faktisk genererer klipp.

Native multi-shot-scener. Modellen kan rendre sammenhengende scener, fra totalbilde til halvtotalt til nærbilde, i én enkelt generering, og holder karakteren, settingen, belysningen og stemmen stabil gjennom kuttene. Før måtte man rendre hvert klipp for seg og håpe at ansikt og lys stemte overens. Dette er endringen som forvandler et klipp til en scene.

En ny diffusjonsvideoavkoder. Den mest synlige forbedringen på vanlig opptak: færre artefakter i scener med mye bevegelse, nøyaktig der tidligere versjoner mistet detaljer. Et hode som snur seg raskt, en rask pann, hår i bevegelse, alt henger bedre sammen, mens den høye kompresjonsraten LTX-familien er avhengig av, er beholdt.

En bedre tekstkoder. Prompthåndtering er nå flyttet til en finjustert Gemma 4 12B-koder kombinert med en dedikert promptforbedrer. I praksis leser den komplekse, flerpersonlige instruksjoner fra kortere prompter, slik at du bruker mindre tid på å overspesifisere.

Automatisk varighet. Klipplengden utledes fra handlingen du beskriver i stedet for å settes manuelt i bilder, og native 4K HDR er nå en del av pipelinen i stedet for et etterarbeidssteg.

For å sette det i perspektiv: på datasentermaskinvare rendrer LTX-2.5 10 sekunder med 720p på under 7 sekunder. Det tallet er det som gjør skyrendering fakturert per klipp levedyktig i det hele tatt.

Dette er muligheter i motoren. De kommer inn i tendre.AI gradvis, versjon for versjon. Endringsloggen er referansen for hva som er live i versjonen du kjører.

Hvordan tendre.AI integrerer LTX-2.5

tendre.AI følger sin vanlige regel: lokalt først, sky kun for den tunge løftingen du velger.

  • Bilder er 100% lokale. Hvert stillbilde genereres på din egen GPU, ingenting lastes opp.
  • LTX-2.5-video kjøres på en sky-GPU, på forespørsel. Synkronisert lyd og særlig 4K er beregningskrevende, så det kjøres på en ekstern GPU og faktureres per klipp i credits. Det er valgfritt: hvis du bare genererer bilder, endres ingenting i din private lokale arbeidsflyt.
  • Samme karakterer i begge. Fordi video starter fra dine lokale stillbilder, bæres identiteten du har bygget videre inn i klippet.

Migrasjonsnotat: tendre.AI ruller aktivt ut LTX-2.5 i appen. Video med lyd, 1080p-utprøving og 4K-ferdigstilling kommer inn gradvis etter hvert som migrasjonen fullføres. Den lokale bildearbeidsflyten er upåvirket.

Innholdsgrensen gjelder fortsatt

LTX-2.5 endrer ikke tendre.AIs faste regel. Alt som genereres er 100% syntetisk: ingen virkelig person er avbildet, og alle motiver er utvetydig voksne. Modellen er et verktøy for fiktivt, voksent, AI-generert innhold, ingenting annet.

Generer video med lyd i tendre.AI

LTX-2.5 gir synkronisert lyd og video, i 1080p og 4K, oppå en 100% lokal bildearbeidsflyt. Ett verktøy for bilde og video, uten abonnement.

AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Cyberpunk Universe)AI-generated portrait by tendre.AI (Fantasy Universe)AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Library)AI-generated portrait by tendre.AI (At work)AI-generated portrait by tendre.AI (FarWest)AI-generated portrait by tendre.AI (Cyberpunk UNIVERSE)AI-generated portrait by tendre.AI (Exterior)