VAE (вариационный автоэнкодер)
VAE, или вариационный автоэнкодер, это компонент, который переводит компактное внутреннее представление, в котором работает диффузионная модель (оно называется латентным пространством), в реальные пиксели итогового изображения. Он сжимает изображения для эффективной обработки в процессе генерации, а затем декодирует результат обратно в полноразмерную картинку, и это заметно влияет на точность цветопередачи и мелкие детали.
В tendre.AI к каждому поддерживаемому чекпоинту уже подобран подходящий VAE, так что изображения декодируются корректно без каких-либо дополнительных настроек.