LTX-2.5: открытые веса, 10-секундный клип за 6,8 секунды и 4K HDR прямо в монтажку
Пока Alibaba запирает свой новый флагман Wan 3.0 за платным API, LTX выкатывает ровно противоположное: LTX-2.5 — открытые веса, качай и запускай на своём железе. Быстрее реального времени, с нативным 4K HDR и поддержкой в ComfyUI с первого дня.
Цифра, ради которой всё затевалось
10-секундный клип из картинки в 720p — за 6,8 секунды. Это на паре NVIDIA GB200 в собственном дата-центре. Через управляемый API тот же ролик занимает 23,7 секунды, причём уже в 1080p. Для калибровки, по замерам самой LTX на одинаковой задаче: Grok 1.5 — 63 секунды, Veo 3.1 — 70, MiniMax H3 — 180, Seedance 2.0 — 196, FLUX 3 — 259, Seedance 2.5 — 317, Kling 3.0 Pro — 398. Цифры вендорские, но порядок разрыва понятен: генерация перестала быть «поставил и пошёл пить кофе».
Что внутри: пайплайн переписан, а не залатан
Diffusion Fidelity Rendering — главная новинка. Модель сперва строит движение и структуру сцены в латентном пространстве, сжатом по времени в 8 раз, параллельно генерируя опорные кадры высокой чёткости. Компьют распределяется по сложности: на визуально нагруженные моменты его выделяется больше, на простые — меньше. Потом отдельная диффузионная стадия дорисовывает финальную картинку. Новый диффузионный видеодекодер пришёл на смену обычному VAE-декодеру и вытаскивает мелочи, которые раньше замыливались под компрессией — в первую очередь лица.
Мультишот и понимание промпта
Сцена из нескольких планов генерируется как один результат, а не склеивается из отдельных запусков: персонаж, окружение, свет и голос держатся через склейки. Понимание промпта переехало на кастомный бэкбон Gemma 4 плюс отдельный улучшайзер промптов. Добавили автоопределение длительности — модель сама подбирает хронометраж под запрошенное действие.
HDR, ACES и RAW
LTX-2.5 умеет нативный 4K HDR и работает в ACES: 16-битные линейные данные в EXR заходят в модель и выходят из неё с сохранённым динамическим диапазоном. Генерация впервые встраивается в нормальный колор-пайплайн, а не отдаёт пережатый файл, который стыдно тянуть в грейдинг. Плюс автоматическая конвертация SDR в HDR с восстановлением выбитых светов.
Железо и лицензия
Вместе с NVIDIA модель оптимизировали под локальный инференс на RTX и DGX Spark. Заявленный минимум — 16 ГБ видеопамяти, запуск от Mac до дата-центровой карты. Бесплатно для организаций с годовой выручкой до 10 млн долларов, крупнее — договорная лицензия. Семейство LTX перевалило за 33 миллиона скачиваний. Партнёры запуска: ComfyUI, продакшен-студия Asteria, платформа реалтайм-видео Reactor и робототехническая Markov Robotics. Отдельно выложен предобученный чекпойнт под физический ИИ и робототехнику.
Честная приписка
Релиз объявлен 11 августа, раскатка идёт на глазах: карточки LTX-2.5 на Hugging Face пока отдают запрос авторизации, а официальная документация и туториалы ComfyUI всё ещё описывают LTX-2.3. Если качается не с первого раза — это релизный день, а не вы.
Скачать и запустить: веса на Hugging Face, инференс и LoRA-тренер, ноды ComfyUI, LTX Desktop, документация, попробовать онлайн.
Источники: пресс-релиз LTX, блог LTX, карточка модели. Больше разборов — НЕЙРО-ПУШКА ● Новости и обзоры нейросетей.
















