Hoe schrijf je een goede LTX-2.5-prompt (video met geluid)

2 juli 2026

Een videomodel prompten is niet hetzelfde als een afbeeldingsmodel prompten. Met SDXL beschrijf je een bevroren moment. Met LTX-2.5 beschrijf je een bewegende opname met geluid, dus twee dingen die je nooit eerder hoefde te schrijven spelen opeens een grote rol: beweging en audio. Doe je dat goed, dan voelen je clips intentioneel aan; negeer je ze, dan krijg je een stijf, geluidloos diashow. Deze gids laat je zien hoe je LTX-2.5-prompts schrijft die echt bewegen en goed klinken.

De ene fout die je moet vermijden: prompten als een afbeelding

De meest gemaakte beginnersfout is een scène beschrijven in plaats van een shot. "Een vrouw in een rode jurk in een café" is een afbeeldingsprompt. LTX-2.5 rendert er iets mee, maar zonder bewegingsinstructie moet het model zelf raden, en het raadt doorgaans minimaal (een kleine hoofdbeweging, een flikkering). Je eindigt met een bijna-stilstaande clip.

Los het op door altijd drie vragen te beantwoorden die het model niet kan afleiden uit een statische beschrijving:

  • Wat beweegt? (het onderwerp, de camera, of allebei)
  • Hoe gedraagt de camera zich? (statisch, pan, dolly, handheld)
  • Wat horen we? (sfeergeluid, stem, effecten)

Een promptformule die werkt

Zie een LTX-2.5-prompt als zes slots. Je hoeft ze niet allemaal in te vullen, maar hoe meer je invult, hoe meer controle je hebt:

Onderwerp + Actie/Beweging + Camera + Omgeving/Belichting + Stijl + Audio

Voorbeeld, slot voor slot:

Een jonge vrouw in een rode jurk (onderwerp) draait zich naar de camera en glimlacht (actie), trage dolly-in (camera), warm gouden-uurlicht door een raam (omgeving/belichting), filmisch, ondiepe scherptediepte (stijl), zachte ruimteklank met een vaag vinylgekraak (audio).

Die ene zin vertelt LTX-2.5 wat er gebeurt, hoe het gefilmd wordt en hoe het klinkt. Dat is het hele verhaal.

Beschrijf beweging met werkwoorden

Beweging zit in werkwoorden. Zwakke prompts staan vol zelfstandige naamwoorden en bijvoeglijke naamwoorden; sterke prompts voegen actiewoorden toe: draait, loopt, leunt, reikt, kantelt, kijkt, ademt, wiegt, zweeft. Beperk je tot één duidelijke actie per korte clip. Een opname van 5 seconden kan niet "ze staat op, loopt naar het raam, opent het en steekt een sigaret op" laten zien, dat zijn vier shots. Vraag om één moment, land het, en genereer daarna het volgende.

Spreek de taal van de camera

LTX-2.5 begrijpt cinematografische termen. Gebruik ze om het beeld te sturen:

  • Shot-formaat: close-up, medium shot, wide shot.
  • Camerabeweging: statisch shot, trage pan naar links, dolly-in, tracking shot, handheld.
  • Gevoel: vast en stabiel, of subtiele handheld-beweging voor realisme.

"Statisch shot, close-up" is een totaal andere clip dan "handheld tracking shot, wide", zelfs met hetzelfde onderwerp. Kies de camera bewust.

Prompt het geluid, dit is de superkracht van LTX-2.5

Omdat LTX-2.5 beeld en geluid tegelijk genereert, kun je de audio direct in je prompt schrijven, en dat zou je ook moeten doen. Drie lagen om over na te denken:

  • Sfeergeluid / ruimteklank: "rustige ruimteklank", "regen op een raam", "ver stadsverkeer", "golven".
  • Stem / dialoog: beschrijf de manier van spreken ("een zachte fluistering", "een warme lach") in plaats van exacte woorden als je het natuurlijk wilt houden.
  • Effecten: "voetstappen op hout", "een deur kraakt", "vinylgekraak", "een zachte bries".

Als je niets zegt over audio, vult LTX-2.5 het zelf in, en dat matcht misschien niet met de sfeer die je wilde. Eén korte audiozin is meestal genoeg om het bij te sturen.

Wat er veranderde met 2.5, en hoe dat je prompts beïnvloedt

Versie 2.5 heeft drie dingen verschoven die direct van invloed zijn op hoe je schrijft.

Je kunt een reeks prompten, niet alleen een shot. LTX-2.5 genereert native multi-shot scènes: wide, dan medium, dan close-up, in één enkele generatie, waarbij het personage, de belichting en de stem stabiel blijven over de cuts heen. Beschrijf dus de reeks in plaats van drie clips te renderen en die vervolgens te proberen te matchen. "Wide shot van haar op het terras bij schemering, dan medium terwijl ze zich naar de deur draait, dan close op haar gezicht terwijl ze spreekt."

Kortere prompts werken nu beter. Promptverwerking is overgestapt op een fijn afgestelde Gemma 4 12B-encoder met een speciale promptversterker, die complexe, meervoudige instructies leest uit minder woorden. De oude gewoonte om twintig kwalificaties op te stapelen om een resultaat te forceren werkt nu averechts: het beperkt het model meer dan het het stuurt. Zeg wat er toe doet, laat de opvulling weg.

Stop met het tellen van frames. De duur wordt afgeleid uit de actie die je beschrijft. Schrijf de actie op zijn natuurlijke lengte, "ze schenkt de koffie in, kijkt op en glimlacht", en laat het model de clip op maat maken. Een lengte handmatig instellen en dan een actie beschrijven die er niet in past, is hoe je een einde krijgt dat afgeknipt aanvoelt.

Tekst-naar-video vs. afbeelding-naar-video

De twee startpunten vragen om iets andere prompts:

  • Tekst-naar-video: je beschrijft alles, inclusief het onderwerp. Gebruik de volledige zes-slot-formule.
  • Afbeelding-naar-video (aanbevolen in tendre.AI): je stilstaande beeld definieert al het onderwerp, de look en de framing. Houd de beschrijving van het onderwerp dus licht en besteed je woorden aan de beweging en audio die je wilt toevoegen. Voorbeeld bovenop een bestaand portret: "ze kantelt langzaam haar hoofd, haar beweegt in een lichte bries, subtiele glimlach, statische camera, zacht ademgeluid en ver stadsgeruis". Je animeert, je beschrijft niet opnieuw.

Afbeelding-naar-video is de sweet spot: het personage dat je lokaal hebt vastgelegd (met een LoRA of een vaste seed) gaat direct de clip in, hetzelfde gezicht, dezelfde stijl.

Itereer op 1080p, maak af in 4K

Prompts worden gevonden, niet geschreven. Draft op 1080p zodat elke poging snel gaat: draai het, kijk en luister, verander één ding (een sterkere camerabeweging, een duidelijkere audiocue), draai opnieuw. Wanneer het shot klopt, render je de keeper in 4K. Verander één variabele tegelijk zodat je weet wat er daadwerkelijk hielp.

Twee voorbeelden die je kunt aanpassen

Tekst-naar-video, filmisch:

Medium shot van een vrouw bij een raam met regendruppels, ze draait langzaam haar hoofd naar de camera en glimlacht, trage dolly-in, moeiteloze blauwe avondbelichting, filmisch filmkorrelig, zachte regen op glas en een laag omgevingsgeruis.

Afbeelding-naar-video, vanuit een lokale stilstaande foto:

Ze ademt zachtjes en knippert, een paar haarstrengjes waaien in een lichte bries, statisch vergrendelde camera, ondiepe scherptediepte behouden, rustige ruimteklank met een vaag tikkend uurwerk.

Beide zijn kort, noemen één duidelijke actie, stellen de camera in en geven het geluid één instructie. Dat is het patroon.

Wel en niet doen

  • Wel één actie noemen, één cameragedrag, één audio-idee.
  • Wel cinematografische woorden gebruiken (close-up, dolly-in, handheld).
  • Niet vier acties in één clip van 5 seconden proppen.
  • Niet de audio leeg laten als de sfeer belangrijk is.
  • Niet het onderwerp opnieuw beschrijven bij afbeelding-naar-video, animeer het.

Hoe dit past bij tendre.AI

In tendre.AI blijven afbeeldingen 100% lokaal op je eigen GPU. LTX-2.5-video draait op een cloud-GPU op aanvraag, per clip afgerekend in credits, zodat je afbeeldingen privé draftet en alleen credits uitgeeft wanneer je een keeper animeert. Omdat video begint vanuit je lokale stilstaande beeld, gaat het personage dat je hebt gebouwd direct de clip in, hetzelfde gezicht, dezelfde look, nu met beweging en geluid.

Alles wat gegenereerd wordt is 100% synthetisch: er wordt geen echte persoon afgebeeld, en elk onderwerp is onmiskenbaar een volwassene.

Zet je afbeeldingen om in video met geluid

Schrijf de beweging, schrijf het geluid, en laat LTX-2.5 de stilstaande foto die je lokaal hebt gegenereerd animeren. 1080p om te itereren, 4K om af te maken, geen abonnement.

AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Cyberpunk Universe)AI-generated portrait by tendre.AI (Fantasy Universe)AI-generated portrait by tendre.AI (Exterior)AI-generated portrait by tendre.AI (Library)AI-generated portrait by tendre.AI (At work)AI-generated portrait by tendre.AI (FarWest)AI-generated portrait by tendre.AI (Cyberpunk UNIVERSE)AI-generated portrait by tendre.AI (Exterior)