Генерация видео нейросетью по тексту и фото — NetRoom
ВОЗМОЖНОСТЬ

Генерация видео нейросетью по тексту и фото

Описываете сцену словами — получаете готовый ролик в MP4: горизонтальный, вертикальный или квадратный, у некоторых моделей — сразу со звуковой дорожкой. Можно пойти от картинки: приложите кадр, и модель оживит его, а у части моделей задаётся ещё и финальный кадр, между которыми строится движение.

до 10 с
длина одного ролика
3
формата кадра
MP4
файл на выходе

Как это работает

  1. Опишите сцену или приложите кадр

    Текстовое описание обязательно в обоих режимах: оно задаёт, что происходит в кадре. Стартовая картинка нужна, только если вы хотите оживить конкретное изображение.

  2. Соберите параметры

    Соотношение сторон, разрешение и длительность — конкретные варианты берутся из настроек выбранной модели. Там же тумблер звука и негативный промпт, если модель их поддерживает.

  3. Запустите и уйдите со страницы

    Рендер идёт на сервере. Прогресс виден в процентах, а панель очереди остаётся поверх интерфейса при переходе в другой раздел — задача досчитается без вас.

  4. Заберите ролик

    Готовый файл появляется в личной галерее, как правило — с обложкой по первому кадру. Оттуда его можно посмотреть, скачать, а в Telegram — получить сообщением от бота.

Что умеет

На входе
Текстовое описание ролика; по желанию — стартовый кадр, а у части моделей ещё и финальный
Режимы
Текст в видео и кадр в видео — один клип за запуск
Соотношения сторон
16:9, 9:16, 1:1; доступный набор задаёт модель
Длительность
5, 8 или 10 секунд в зависимости от модели
Разрешение
Набор доступных размеров задаёт выбранная модель
Частота кадров
По умолчанию 24 кадра в секунду
Звук
У моделей со звуковой дорожкой — тумблер: ролик приходит сразу озвученным
Негативный промпт
Описание того, чего в кадре быть не должно; поддерживают не все модели
Где доступно
Отдельный экран генерации, раздел видео в дашборде и Студия

Для каких задач

Вертикальные ролики

Формат 9:16 — под вертикальные ленты и шортс, где горизонтальный кадр обрезается по краям.

Оживить фотографию

Приложите снимок или иллюстрацию — модель добавит движение. У части моделей можно задать и финальный кадр, тогда ролик строится как переход от первого ко второму.

Заставки и превью

Горизонтальные 16:9 на 5-10 секунд — для шапки материала или короткой перебивки.

Ролик со звуком

Модели со звуковой дорожкой отдают видео уже с аудио, без отдельного шага озвучки.

Модели для этой задачи

Весь каталог
Видео
ByteDance Seedance 2.0 Mini
Компактная версия Seedance 2.0 от ByteDance — кинематографичное понимание промпта флагмана, но быстрее и дешевле. T2V, I2V, V2V, референс-из
3.89 ₽ / сек
Видео
Gemini Omni Flash
Мультимодальная видеомодель Google из семейства Gemini Omni, преемник Veo 3.1 в приложении Gemini (релиз 30 июня 2026). Генерирует и редакти
10.94 ₽ / сек
Видео
Grok Imagine Video
xAI Grok Imagine Video — мультимодальная видео-модель с нативным синхронизированным аудио: T2V, I2V, V2V; 480p и 720p; до 15 секунд
5.4 ₽ / сек
Видео
HeyGen Avatar IV
Реалистичные говорящие аватары из фото + текст/аудио ввод
10.8 ₽ / сек
Видео
Kling VIDEO 3.0 Pro
Pro-версия Kling 3.0: 1080p, аудио, motion sync, character consistency Генерация занимает до 5 минут.
12.1 ₽ / сек
Видео
Kling VIDEO 3.0 Standard
Доступная версия Kling 3.0: 1080p, аудио, motion sync Генерация занимает до 5 минут.
9.07 ₽ / сек
Видео
Kling VIDEO O3 Pro
Флагманская видео-модель с поддержкой 1080p, first/last frame и Image-to-Video Генерация занимает до 5 минут.
12.1 ₽ / сек
Видео
Kling VIDEO O3 Standard
Стандартная версия O3: оптимальное соотношение качества и цены Генерация занимает до 5 минут.
9.07 ₽ / сек
Видео
Seedance 2.0
ByteDance Seedance 2.0 — мультимодальная видео-модель с синхронным аудио. Принимает текст, картинки, видео и аудио (до 9 reference images, 3
7.56 ₽ / сек
Видео
SkyReels V4
Skywork SkyReels V4 — унифицированная мультимодальная видео-модель: text-to-video, image-to-video, video-to-video, edit и extend. До 1080p,
11.88 ₽ / сек
Видео
Sora 2
Флагманская видео-модель OpenAI с поддержкой аудио, 720p, T2V и I2V
10.8 ₽ / сек
Видео
Sora 2 Pro
Высококачественная версия Sora 2 с поддержкой 1080p
32.4 ₽ / сек

Что ещё умеет

Возможности, о которых обычно узнают уже в процессе работы.

  • В режиме «кадр в видео» ролик наследует геометрию приложенного кадра; у отдельных моделей размеры задаются вместе с ним
  • Основа задаётся одним источником на запуск — стартовым кадром или клипом-образцом
  • Генерация по клипу-образцу доступна на отдельном экране генерации и во вкладке «По референсу»
  • Стартовый кадр — файл до 10 МБ

Частые вопросы

Какой длины получится ролик?

5, 8 или 10 секунд — набор вариантов зависит от модели. Потолок для одного запуска — 10 секунд.

Можно ли оживить фотографию?

Да. Приложите снимок как стартовый кадр и опишите, что должно происходить в сцене: текстовое описание нужно и в этом режиме. У части моделей задаётся ещё и финальный кадр, тогда движение строится от первого ко второму.

У каких моделей ролик приходит со звуком?

У моделей со звуковой дорожкой: в их настройках есть тумблер звука, и готовый ролик приходит уже озвученным, без отдельного шага озвучки.

Когда списываются деньги за ролик?

Списание происходит после успешного результата. Перед стартом сервис сверяет оценочную стоимость с балансом и, если требуется пополнение, сразу показывает нужную сумму.

Нужно ли оставаться на странице до конца рендера?

Ждать на странице не нужно: задача считается на сервере. Можно уйти в другой раздел — панель очереди останется на экране, а готовый ролик появится в галерее.

В каком виде приходит результат?

Файл MP4, по умолчанию с частотой 24 кадра в секунду. Его можно посмотреть в браузере, скачать кнопкой или получить сообщением от бота в Telegram.

Попробуйте на своей задаче

Стартовый баланс уже на счёте — карта не нужна. Платите только за то, что сгенерировали.