CPU3DИИ-инструменты для 3D, видео и звука

LTX-Video: генератор видео — что умеет и что нужно для запуска

LTX-Video — это генератор видео с открытым кодом от компании Lightricks, решающий задачу image-to-video. Инструмент позволяет превратить статичное изображение в видеоролик, используя локальный запуск на собственном оборудовании.

Что умеет

Авторы позиционируют модель как решение для генерации видео по изображению (image-to-video). В метках репозитория также упоминаются задачи text-to-video и image-to-video-generation, что указывает на поддержку текстовых описаний в качестве дополнительного условия. В основе лежит архитектура diffusion-models и dit, код написан на Python и интегрирован с библиотекой diffusers.

Что нужно для запуска

Код открыт под лицензией Apache-2.0, веса модели распространяются по лицензии LTXV Open Weights License 0.X. Самый большой файл весов занимает 26.6 ГБ, а полный объём всех файлов весов составляет 236.4 ГБ.

По описанию автора, для работы требуется видеопамять объёмом 1 ГБ — дословно: «Requires only 1GB of VRAM». Заявлена поддержка MPS на macOS с PyTorch 2.3.0. Кодовая база тестировалась с Python 3.10.5, CUDA 12.2 и поддерживает PyTorch версии не ниже 2.1.2. Репозиторий создан в ноябре 2024 года, последнее изменение кода датируется январём 2026 года.

Кому подойдёт

Инструмент рассчитан на тех, кто готов к локальному запуску и имеет достаточный объём дискового пространства для хранения весов. Заявленное требование к видеопамяти в 1 ГБ делает модель доступной для широкого круга GPU, включая относительно старые или маломощные карты. Поддержка MPS позволяет работать на компьютерах Mac с Apple Silicon.

Не подойдёт тем, кто ищет облачный сервис без необходимости локальной установки — LTX-Video требует самостоятельного развёртывания из репозитория. Пользователям без опыта работы с Python и командной строкой порог входа может показаться высоким.

Модель и код доступны на GitHub и Hugging Face, дополнительную информацию можно найти на сайте проекта. Веса модели распространяются по лицензии LTXV Open Weights License 0.X: коммерческое использование ограничено порогом выручки.

Конвейер LTX-Video Генератор видео по изображению и тексту Входные данные Исходное изображение Текстовое описание Параметры генерации Image + Text Prompt Кодировщики VAE-кодирование Токенизация текста Латентное представление VAE + T5 Encoder Трансформер DiT Диффузионная модель Предсказание шума Итеративная очистка VRAM: 1 ГБ Diffusion Transformer Декодер VAE-декодирование Восстановление кадров VAE Decoder Результат: видео Сгенерированная видеопоследовательность на основе входного изображения и текстового описания Формат: MP4 / GIF / последовательность кадров Text-to-Video (альтернативный режим) Платформа: MPS (macOS) · Python 3.10 · PyTorch ≥ 2.1.2 · CUDA 12.2 Библиотека: Diffusers · Лицензия кода: Apache-2.0 · Веса: 26.6 ГБ (основной) / 236.4 ГБ (все)
Как устроен конвейер LTX-Video. Схема нарисована по паспорту инструмента.

Паспорт

Задачаimage-to-video источник
Лицензия кодаApache-2.0 источник
Лицензия весовLTXV Open Weights License 0.X: коммерческое использование ограничено порогом выручки источник
ПлатформаMPS по описанию автора источник
Видеопамять1 ГБ по описанию автора источник
Самый большой файл весов26.6 ГБ источник
Все файлы весов236.4 ГБ источник
Python3.10 по описанию автора источник
Библиотекаdiffusers источник
ЯзыкPython источник
Последнее изменение кода2026-01-05 источник
Репозиторий создан2024-11-20 источник
Меняется часто — данные на 14.09.2026
Звёзд на GitHub10931 источник
Форков1125 источник
Загрузок за месяц493260 источник
Обновление модели2025-07-16 источник

Значения собраны автоматически из официальных источников и проверены 14.09.2026. У каждого есть ссылка на источник, а у собранных со страницы разработчика — ещё и дословная цитата: наведите на пометку. Тарифы и версии показаны на дату проверки и меняются чаще всего — перед покупкой сверьтесь с сайтом.

Смотрите также