CPU3DИИ-инструменты для 3D, видео и звука

LingBot-Video: генератор видео — что умеет и что нужно для запуска

LingBot-Video — генератор видео с открытым кодом от Robbyant. Авторы описывают его как модель для предобучения на видео с архитектурой mixture-of-experts, ориентированную на задачи embodied intelligence. В репозитории проект помечен метками image-to-video, video-generation и world-models, то есть основная задача — превращение изображения в видеоряд и построение моделей мира.

Что умеет

По описанию автора, LingBot-Video решает задачу масштабирования mixture-of-experts для видеопредобучения. Практически это означает генерацию видео из изображения — метка image-to-video стоит в репозитории. Детальных примеров сценариев использования авторы в паспорте не приводят, поэтому о конкретных ограничениях по длительности ролика, разрешению или управлению движением сказать нечего.

Что нужно для запуска

Код написан на Python и работает через библиотеку diffusers. Для запуска нужен доступ к весам модели: самый большой файл занимает 4.6 ГБ, все файлы весов вместе — 11.3 ГБ. Авторы не указывают минимальные требования к видеопамяти или оперативной памяти, поэтому оценить, на какой видеокарте это запустится, по паспорту нельзя.

Лицензия и кода, и весов — Apache-2.0. Это разрешает коммерческое использование и модификацию. Код открыт, репозиторий доступен на github.com/Robbyant/lingbot-video, веса — на huggingface.co/robbyant/lingbot-video-dense-1.3b. Есть и отдельный сайт проекта: technology.robbyant.com/lingbot-video.

Кому подойдёт

Проект интересен тем, кто работает с image-to-video генерацией и готов запускать модель локально через diffusers. Открытая лицензия Apache-2.0 на код и веса позволяет встраивать генератор в собственные пайплайны, в том числе коммерческие.

Тем, кто ищет готовый сервис с веб-интерфейсом, LingBot-Video не подойдёт: это репозиторий с кодом и весами, а не облачный продукт. Также стоит учесть, что авторы не публикуют требований к железу — перед запуском придётся самостоятельно проверять, хватит ли памяти на 11.3 ГБ весов и сам процесс генерации.

LingBot-Video — свежий проект: репозиторий создан в июле 2026 года, последнее изменение кода — в августе 2026. Это значит, что документация и примеры могут быть неполными, а поведение модели — недостаточно обкатанным на широком круге задач.

LingBot-Video — конвейер генерации видео Путь от входных данных до готового видео ВХОД Изображение или текст image-to-video world-models ПОДГОТОВКА Токенизация и нормализация diffusers Python МОДЕЛЬ Mixture-of-Experts dense 1.3B веса 11.3 ГБ Apache-2.0 ГЕНЕРАЦИЯ Видео-кадры из изображения video-generation embodied intelligence ВЫХОД Видео файл готовый ролик Открытый код · Apache-2.0 · Разработчик: Robbyant
Как устроен конвейер LingBot-Video. Схема нарисована по паспорту инструмента.

Паспорт

Лицензия кодаApache-2.0 источник
Лицензия весовapache-2.0 источник
Самый большой файл весов4.6 ГБ источник
Все файлы весов11.3 ГБ источник
Библиотекаdiffusers источник
ЯзыкPython источник
Последнее изменение кода2026-08-05 источник
Репозиторий создан2026-07-08 источник
Меняется часто — данные на 05.09.2026
Звёзд на GitHub945 источник
Форков47 источник
Загрузок за месяц208 источник
Обновление модели2026-07-08 источник

Значения собраны автоматически из официальных источников и проверены 05.09.2026. У каждого есть ссылка на источник, а у собранных со страницы разработчика — ещё и дословная цитата: наведите на пометку. Тарифы и версии показаны на дату проверки и меняются чаще всего — перед покупкой сверьтесь с сайтом.

Смотрите также