Видео и аватары

Промты для видео: формула из 4 частей и 14 готовых под рилс

Вы нашли подборку «топ-15 промтов для ИИ-видео», вставили первый, и получили пять секунд, где женщина с вашим лицом делает странный жест, а камера дёргается, как на карусели. Промты из подборок написаны под рекламные ролики брендов, а вам нужно оживить своё фото, сделать вставку в рилс или фон под текст. Это другие промты.

Факты сверены с первоисточниками 30 сентября 2026: справки открывали живьём, цены и лимиты смотрели на сайтах сервисов. Список документов с адресами лежит в конце статьи.

Сначала чем промт для видео отличается от промта для картинки и формула из четырёх частей. Потом слова для движения камеры. Дальше готовые промты по задачам блогера: оживить фото, вставка в рилс, фон под текст, предмет в кадре. Отдельно про длительность, звук, где генерировать из России и определитель по результату.

Короткий ответ

Промт для видео описывает изменение, а не состояние: кто в кадре, одно действие за пять секунд, как движется камера, какой свет. «Девушка в свитере у окна медленно поворачивает голову к камере и улыбается, камера неподвижна, мягкий серый свет из окна, 5 секунд». Несколько действий в одном промте дают кашу, слова «динамично» и «кинематографично» дают случайное движение камеры.

Для оживления своего фото просите минимум движения, тогда лицо держится. Длинный рилс собирается из пятисекундных сцен, каждая своим промтом, звук и голос накладываются на монтаже. Из России первую пробу удобно делать в Алисе AI и +Вайб, зарубежные Kling, Seedance и Veo оплачиваются через посредников.

Чем промт для видео отличается от промта для картинки

КартинкаВидео
описывает состояниеописывает изменение за несколько секунд
композиция и светплюс действие, камера, длительность
ошибка: лишний палецошибка: лицо плывёт к третьей секунде
одна попытка дешёваяодна попытка дорогая по времени и кредитам

Если в промте для видео нет глагола и нет слова про камеру, модель придумывает движение сама. Обычно это тряска и жест, который вы не просили.

Формула: кадр, действие, камера, длительность

ЧастьПример
Кадр«девушка в бежевом пальто на осенней аллее, портрет по пояс»
Действие, одно«идёт навстречу камере, поправляет шарф»
Камера«медленно отъезжает назад на уровне глаз»
Свет и стиль«мягкий пасмурный свет, как снято на телефон»
Длительность«5 секунд»

Одно действие. Если хочется два, это два промта и склейка на монтаже.

Слова для движения камеры

ХотитеПишите
спокойный кадр без движения«камера неподвижна, на штативе»
приблизиться к лицу«медленный наезд на лицо»
показать место«плавная панорама слева направо»
идти рядом с героиней«камера следует за ней сбоку на уровне плеч»
живое, как в сторис«съёмка с руки, лёгкое покачивание»
раскрыть сцену«отъезд назад и вверх»
взгляд сверху на стол«вид сверху, камера неподвижна»

Не работают «динамично», «кинематографично», «эпично»: это не движение, а оценка. Модель подставит своё.

Промты: оживить своё фото

Фото загружается как первый кадр, промт описывает, что с ним происходит. Главное правило: чем меньше движения, тем целее лицо.

Поворот и улыбка

Дыхание кадра

Глоток кофе

Ходьба, повороты корпуса и активные жесты на одном фото почти всегда ломают черты. Как выбирать фото под оживление и что проверять в результате, разобрано в статье про видео из фото нейросетью.

Промты: вставка для рилса

Вставка это два-пять секунд, которые перекрывают вашу говорящую голову и показывают, о чём речь. Лицо тут не нужно, поэтому промты свободнее.

Утро блогера

Телефон и уведомления

Город из окна

Такие вставки дешевле искать в библиотеках стоков, но нейросеть выигрывает, когда нужен точный предмет или ракурс, которого в стоках нет.

Промты: фон под текст и заставка

Фон для текста в сторис

Заставка рубрики

Строка «часть кадра пустая под текст» решает проблему, когда надпись нечитаема на пёстром фоне.

В телеграм-канале разбираю рилсы участниц: где вставка от нейросети сработала, а где лучше было снять на телефон.Открыть канал ↗

Промты: товар и предмет в кадре

Для интеграций и своих продуктов промт строится вокруг предмета, и здесь лучше загружать фото предмета как первый кадр, иначе модель нарисует похожий, но другой.

Предмет на столе

Предмет в руках

Текст на упаковке проверяйте покадрово: нейросети его портят чаще всего, а в интеграции это сразу претензия от заказчика.

Длительность и почему 5 секунд лучше 10

ДлительностьЧто происходит
3-5 секундодно действие целиком, лицо держится, легко монтировать
6-8 секунднормально для фонов и предметов, для лица уже риск
10 и большек концу плывут черты, появляются лишние движения

Рилс на тридцать секунд собирается из шести сцен по пять секунд. Это дороже по количеству генераций, но каждая сцена управляема, а неудачную вы переделываете одну, а не весь ролик.

Звук и речь: чего пока не просить

Часть моделей генерирует звук вместе с видео. Для блогера это редко нужно: точный текст реплики, русская артикуляция и ваш собственный голос пока ненадёжны, результат приходится проверять покадрово.

Безопасная схема: видео без звука, голос записываете сами, музыку берёте из библиотеки или генерируете отдельно. Что можно ставить в рилс и на каком тарифе, разобрано в статье про авторские права на музыку из Suno.

Где генерировать и что учесть из России

ИнструментПод чтоИз России
Алиса AIоживить фото, простые сценынапрямую, в рублях
+Вайбготовые сцены под тренды по одному-трём фотонапрямую, в рублях
Kling, Seedanceсцены с движением, предметы, вставкичерез сторонние сервисы, оплата через посредника
Veoреалистичные сцены со звукомчерез сторонние сервисы, оплата через посредника

Тарифы и лимиты у всех меняются каждые несколько недель, поэтому здесь их нет: смотрите на странице сервиса в день оплаты. Как повторять конкретные тренды этой осени и что с правами на чужие лица, разобрано в статье про ИИ-тренды осени 2026.

Определитель: видео вышло не таким

Что получилосьПочемуЧто поправить в промте
Каша из движенийнесколько действий в одном промтеодно действие, остальное в следующую сцену
Камера дёргаетсянет слова про камеру«камера неподвижна» или одно движение
Лицо поплыло к концудлительность больше 5 секунд или активное движение5 секунд, минимум движения
Предмет похож, но не тотпредмет описан словамифото предмета первым кадром, «не менять»
Текст на упаковке искажёнмодель дорисовала буквы«надписи не менять», проверка покадрово
Фон пёстрый, текст не читаетсянет пустой зоны«верхняя треть кадра пустая под текст»
Свет скачет между сценамиразный свет в промтаходна строка света во всех сценах ролика

Чего лучше не делать

Не вставлять промты из подборок «топ-15» без переделки: они написаны под рекламные ролики, там нет вашего лица и вашей задачи. Не просить десять секунд с ходьбой и жестами на одном фото, это почти гарантированная переделка.

Не доверять модели речь и текст на предметах без покадровой проверки. И не выкладывать оживлённое фото как реальную съёмку: подписчики видят разницу, а честная подпись «оживила нейросетью» собирает больше вопросов и комментариев, чем молчание.

Памятка

Порядок, при котором из десяти генераций девять идут в ролик, а не в корзину.

Частые вопросы

Как написать промт для генерации видео нейросетью?

Опишите один кадр и одно действие в нём: кто в кадре, что делает за пять секунд, как движется камера, какой свет. Например: «Девушка в бежевом пальто идёт по осенней аллее навстречу камере, камера медленно отъезжает назад на уровне глаз, мягкий пасмурный свет, 5 секунд». Промт про десять событий подряд модель не осилит: она сделает кашу или выберет одно.

Чем промт для видео отличается от промта для картинки?

В видео добавляются три вещи, которых нет в картинке: действие во времени, движение камеры и длительность. Промт для картинки описывает состояние, промт для видео описывает изменение. Если в промте нет глагола движения и нет слова про камеру, модель придумает их сама, и обычно это дрожащий кадр с непонятным жестом.

Как оживить своё фото нейросетью по промту?

Загрузите фото как первый кадр и опишите минимальное действие: «Медленно поворачивает голову к камере и улыбается, волосы чуть шевелит ветер, камера неподвижна, 5 секунд». Чем меньше движения вы просите, тем меньше искажений лица. Ходьба, повороты корпуса и жесты руками на одном фото почти всегда ломают черты.

Какие слова описывают движение камеры в промте для видео?

Рабочие: «камера неподвижна», «медленный наезд на лицо», «отъезд назад», «плавная панорама слева направо», «камера следует за героиней сбоку», «съёмка с руки с лёгкой тряской», «вид сверху». Слова «динамично» и «кинематографично» ничего не описывают, и модель делает случайное движение.

Сколько секунд просить в промте для видео?

Пять. Почти все модели делают короткие фрагменты, и на пяти секундах одно действие выглядит цельно, а лицо не успевает уплыть. Десятисекундный ролик чаще разваливается к концу. Для рилса длиннее нужен монтаж из нескольких пятисекундных сцен, каждая своим промтом.

Можно ли попросить нейросеть сгенерировать видео с речью?

Некоторые модели генерируют звук и речь, но точный текст реплики, русская артикуляция и ваш голос пока ненадёжны, и результат нужно проверять покадрово. Для рилса безопаснее генерировать видео без звука и накладывать свой голос или музыку при монтаже. Про музыку и права на неё есть отдельная статья.

Где генерировать видео по промту из России?

Из российских сервисов есть режим анимации фото в Алисе AI и готовые сцены под тренды в +Вайб. Зарубежные Kling, Seedance, Veo доступны через сторонние сервисы и оплачиваются через посредников. Для первой пробы начните с российских: русский промт понимают, оплата в рублях.

Почему видео из нейросети выглядит как каша?

Три причины: в промте несколько действий сразу, нет слова про камеру, длительность больше пяти секунд. Разбейте на сцены по одному действию, добавьте «камера неподвижна» или одно конкретное движение, ограничьте пятью секундами. Это решает большинство случаев без смены сервиса.

Источники

Всё, на что опирается разбор, с датой, когда документ открывали. Сервисы меняют цены и правила молча, поэтому дата тут важнее ссылки: если она старая, цифру стоит перепроверить по первоисточнику.

  1. Тренд Литвина: танец на заправке через ИИ

    vc.ruоткрыто 30 сентября 2026

    Разбор тренда сентября 2026: в +Вайб от Яндекса есть готовая сцена под этот тренд, нужны одна-три фотографии, генерация занимает от пяти до пятнадцати минут, сервис просит подтвердить согласие людей на фото. Первоисточник Яндекса в статье не цитируется дословно.

  2. ИИ-тренд с зомби: видео-объятия с зомби по фото пары

    vc.ruоткрыто 30 сентября 2026

    Разбор тренда сентября 2026 с перечислением моделей, в которых его делают: Kling 3.0, Seedance 2.5, Veo 3.1 для видео, Nano Banana Pro для картинки, на входе два портретных фото. Цены и лимиты сервисов в статье не проверялись.

ИИ-офис — Проект про работу с нейросетями: разборы инструментов, рабочие связки и практика, проверенная на своих задачах.