LTX-2.5: tendre.AI:n ääni- ja videomalli
26. kesäkuuta 2026
LTX-2.5 on äänen ja videon generointimalli, joka pyörittää videoita tendre.AI:ssa. Se kuuluu LTX-perheen videodiffuusiomalleihin, ja sen tärkein ominaisuus on se, että se tuottaa kuvan ja äänen yhdessä, yhdellä mallilla, sen sijaan että tekisi ensin äänettömän klipin ja jättäisi äänen erillisen työkalun tehtäväksi. Tämä artikkeli on selkokielinen tekninen katsaus siihen, miten se toimii ja miten tendre.AI integroi sen.
Miksi yhteinen ääni-videomalli on tärkeä
Vanha tapa saada äänellinen klippi oli putkilinja: videomalli tekee kuvat, äänimalli tekee raidan, ja sitten synkronoit ne käsin. Ongelma on juuri synkronointi. Ääni, joka on tuotettu ilman että malli "näki" liikettä, ei osu täsmälleen: askelääni puoli iskua myöhässä, puhe joka ei vastaa suun liikkeitä, taustaäänet jotka eivät piittaa kohtauksesta.
LTX-2.5 romuttaa tämän putkilinjan. Koska sama malli tuottaa sekä kuvat että äänen, ne ovat rakenteellisesti yhtenäiset: ääniraita on ehdollistettu samaan sisältöön kuin kuva, joten liike ja ääni ovat synkronissa jo ensimmäisestä generoinnista, eikä niitä tarvitse paikata jälkikäteen.
Arkkitehtuuri selkokielellä
LTX-2.5 on diffuusiotransformeri (DiT). Kaksi ideaa, joiden ymmärtäminen auttaa:
- Diffuusio tarkoittaa, että malli lähtee kohinasta ja poistaa kohinaa askel askeleelta kohti klippiä, joka vastaa promptiasi. Se on sama periaate kuin moderneissa kuvamalleissa kuten SDXL, laajennettuna ajalle.
- Transformeri tarkoittaa, että malli käy läpi koko sekvenssin (kuvien yli ja äänivirran yli) sen sijaan, että käsittelisi jokaisen kuvan erikseen. Tämä globaali näkymä on syy siihen, miksi liike pysyy vakaana ja ääni lukittuu toimintaan klipin koko pituudelta.
Koko klipin käsittely kerralla yksittäisten kuvien sijaan on perussyy siihen, miksi tulos pysyy yhtenäisenä: objektit säilyttävät muotonsa, kameran liike pysyy sulavana, ja ääni seuraa kuvaa.
Tekstistä videoksi ja kuvasta videoksi
LTX-2.5 tukee kahta lähtöpistettä, ja tendre.AI käyttää molempia:
- Tekstistä videoksi: kuvaa kuvauspaikka, saat äänellisen klipin.
- Kuvasta videoksi: aloita paikallisesti tendre.AI:ssa jo generoimastasi still-kuvasta ja animoi se. Ensimmäinen kuva on sinun kuvasi, joten sillä lukitsemasi hahmo ja tyyli (esimerkiksi LoRAlla tai kiinteällä seedillä) siirtyvät suoraan videoon.
Kuvasta videoksi -toiminto on se, mikä tekee "yksi työkalu kuvalle ja videolle" -työnkulun todelliseksi: haluamastasi kuvasta tulee klipin avausruutu, sama kasvot, sama ilme.
Resoluutio: 1080p iterointiin, 4K lopullisiin versioihin
Sama malli tukee useita resoluutioita. Käytännössä se tarjoaa selkeän työnkulun:
- 1080p (Full HD) iterointiin: tarpeeksi nopea, jotta voit kokeilla promptia, kuulla tuloksen, säätää ja ajaa uudelleen.
- 4K (Ultra HD) lopullisiin renderöinteihin: nelinkertainen pikselimäärä suurille näytöille tai leikkaus- ja stabilointivaran saamiseksi jälkituotannossa.
Luonnostelet 1080p:ssa, lukitset otoksen (liike, sommittelu, ääni), ja viimeistelet hyvän oton 4K:ssa ilman, että vaihdat moottorin luonnosten ja toimituksen välillä.
Tehokkuus on keskeistä
LTX-sarja tunnetaan siitä, että se on nopea suhteessa laatuunsa. Tehokkuus ei ole pelkkä mainoskannanotto: se on se, mikä tekee nopeista 1080p-luonnoksista ja tilauskohtaisista 4K-finaleista käytännöllisiä yön yli kestävien töiden sijaan. Malli, joka on tarpeeksi tehokas iterointiin, muuttaa työtapasi: tutkit enemmän ottoja, koska jokainen on ajallisesti halpa.
Mitä versio 2.5 toi mukanaan
Lightricks julkaisi LTX-2.5:n avoimilla painoilla 11. elokuuta 2026. Neljä sen muutoksista on merkityksellisiä kaikille, jotka oikeasti generoivat klippejä.
Natiivi moniottoisuus. Malli voi renderöidä toisiinsa liitettyjä otoksia, laajasta kuvakulmasta lähikuvaan, yhdessä generoinnissa, ja pitää hahmon, ympäristön, valaistuksen ja äänen vakaana leikkausten yli. Aiemmin sekvenssi tarkoitti jokaisen otoksen renderöimistä erikseen ja toivomista, että kasvot ja valaistus täsmäävät. Tämä muutos tekee klipistä kohtauksen.
Uusi diffuusiovideodekooderi. Selkein parannus tavallisessa materiaalissa: vähemmän artefakteja runsasliikkeisillä kohtauksissa, juuri siellä, missä aiemmat versiot suttasivat. Nopeasti kääntyvä pää, nopea panorointi, liikkuva tukka, kaikki pysyvät koossa paremmin, samalla kun LTX-perheen käyttämä korkea pakkaustaso säilyy.
Parempi tekstikooderi. Promptinkäsittely siirtyi hienosäädettyllyyn Gemma 4 12B -koodaajaan yhdistettynä omistettuun prompt-tehostimeen. Käytännössä se lukee monimutkaiset, useita kohteita sisältävät ohjeet lyhyemmistä prompteista, joten käytät vähemmän aikaa liialliseen täsmentämiseen.
Automaattinen kesto. Klipin pituus johdetaan kuvaamastasi toiminnasta sen sijaan, että asettaisit sen käsin kuvaruuduissa, ja natiivi 4K HDR on nyt osa putkilinjaa jälkiprosessin sijaan.
Mittakaavan ymmärtämiseksi: konesalilaiteistolla LTX-2.5 renderöi 10 sekuntia 720p-videota alle 7 sekunnissa. Tämä luku on se, mikä tekee klippikohtaisesta pilvipohjaisesta laskutuksesta ylipäätään käytännöllisen.
Nämä ovat moottorin ominaisuuksia. Ne tulevat tendre.AI:hin asteittain, julkaisu julkaisulta. Muutosloki on viite siihen, mikä on käytettävissä sinun käyttämässäsi versiossa.
Miten tendre.AI integroi LTX-2.5:n
tendre.AI noudattaa tavallista sääntöään: paikallinen ensin, pilvi vain raskaaseen prosessointiin jonka itse valitset.
- Kuvat pysyvät 100% paikallisina. Jokainen still generoidaan omalla GPU:llasi, mitään ei ladata palvelimelle.
- LTX-2.5-video ajetaan pilvi-GPU:lla tilauksen mukaan. Synkronoitu ääni ja erityisesti 4K ovat laskentaintensiivisiä, joten ne ajetaan etä-GPU:lla ja laskutetaan per klippi krediiteissä. Se on opt-in: jos generoit vain kuvia, mikään sinun yksityisessä paikallisessa työnkulussasi ei muutu.
- Samat hahmot molemmissa. Koska video alkaa paikallisista still-kuvistasi, rakentamasi identiteetti siirtyy klippiin.
Siirtymähuomio: tendre.AI ottaa LTX-2.5:n käyttöön sovelluksessa aktiivisesti. Ääntä sisältävä video, 1080p-iterointi ja 4K-viimeistely tulevat käyttöön asteittain siirtymän edetessä. Paikallinen kuvatyönkulku ei muutu.
Sisältöraja pätee edelleen
LTX-2.5 ei muuta tendre.AI:n tiukkaa sääntöä. Kaikki generoitu on 100% synteettistä: oikeita henkilöitä ei kuvata, ja jokainen kohde on kiistattomasti aikuinen. Malli on työkalu fiktiiviselle, aikuisille suunnatulle, tekoälyllä generoidulle sisällölle, ei muulle.
LTX-2.5 tuo synkronoidun äänen ja videon, 1080p- ja 4K-versioina, 100% paikallisen kuvatyönkulun päälle. Yksi työkalu kuvalle ja videolle, ei tilausta.








