Как оживить фото нейросетью: движение, мимика и голос для говорящего портрета

Из любой фотографии можно сделать короткое видео. Человек на снимке начнёт моргать и улыбаться, на пейзаже зашевелится трава, на воде появится рябь. Для этого нужна нейросеть и режим image to video. На Syntasy.pro он работает без VPN. В статье покажем, какое фото подойдёт, как выбрать модель, написать промт и сделать так, чтобы человек на снимке заговорил.

Статьи и разделы

Что происходит с фото?

Нейросеть берёт ваше фото как первый кадр видео. Она определяет, что на нём изображено: человека, фон, предметы, свет. Затем по вашему описанию рисует следующие кадры. Обычно получается ролик на несколько секунд. Если нужно длиннее, его можно продлить. Как это сделать в Seedance 2.0, мы уже рассказывали в отдельной статье. Чтобы сделать видео со своим лицом, пользуйтесь другой инструкцией: «Как снять видео о себе с помощью ИИ».

Какой снимок подойдёт

От фотографии зависит результат, поэтому выбирайте снимок внимательно. Лицо должно быть чётким и хорошо освещённым. Если фото тёмное или размытое, видео получится таким же. Лучше всего работают снимки, на которых один или два человека. Если в кадре шесть человек, лица на видео могут смешаться. Ещё стоит проверить руки. Если они закрывают лицо, пальцы на видео часто выходят искажёнными. Не берите фото слишком маленького размера. Если снимок несколько раз пересылали в мессенджерах, он обычно сильно сжат и теряет качество. Если на старом фото есть пятна и трещины, сначала исправьте их. Как это сделать, описано в статье про реставрацию в GPT Image. После анимации дефекты станут заметнее, и убрать их будет сложнее.

Какую модель выбрать?

На платформе есть несколько видеомоделей, и каждая лучше справляется со своей задачей.

Kling O3 сохраняет внешность человека на протяжении всего ролика. Лицо в начале и в конце видео остаётся тем же, поэтому эту модель стоит брать для портретов.

Seedance 2.5 создаёт до 30 секунд видео за один раз, без склейки. Она подойдёт, если вам нужен длинный ролик.

MiniMax H3 генерирует картинку и звук в одном запросе. Её удобно использовать, когда нужно, чтобы человек на фото заговорил.

Gemini Omni принимает текст, изображения и голос одновременно.

Заранее сказать, какая модель лучше справится с вашим фото, нельзя. Проще загрузить снимок в workflow, запустить его на двух-трёх моделях и сравнить результаты. Как это сделать, написано в гайде «Как сравнить результаты разных моделей в одном workflow».

Как оживить фото, инструкция

  • Откройте на Syntasy.pro раздел с видеомоделями и выберите модель.
  • Загрузите фото. Оно станет первым кадром видео.
  • Напишите в промте, что на снимке должно двигаться.
  • Выберите длительность ролика и формат кадра.
  • Нажмите запуск и дождитесь результата.
  • Посмотрите видео. Если движение слишком резкое, поправьте промт и запустите снова.
Интерфейс Syntasy.pro

Как писать промт движения

Промт лучше писать коротко. Укажите, что должно двигаться и насколько быстро. Отдельно напишите, что остаётся на месте.

Примеры для разных снимков:

  • Портрет: «Женщина слегка улыбается, медленно поворачивает голову к камере и моргает. Фон не двигается».
  • Питомец: «Собака поднимает голову и виляет хвостом. Камера неподвижна».
  • Пейзаж: «Ветер качает траву, облака плывут слева направо. Свет остаётся тёплым».
  • Два человека: «Оба смотрят в камеру, улыбаются и слегка покачиваются».

Резкие движения лучше не просить. От них лицо на видео часто искажается. Камеру можно двигать теми же словами, что и в обычном видео: zoom (приближение), pan (поворот), orbit (облёт вокруг), dolly (проезд вперёд или назад). Подробнее об этом в статье про промты для движения камеры. Если добавить слова «медленно» и «плавно», картинка искажается реже.

Примеры промтов

Портрет

  • Женщина слегка улыбается и медленно поворачивает голову к камере. Иногда моргает. Фон не двигается.
  • Мужчина смотрит в камеру, чуть кивает и улыбается. Лицо не меняется, одежда и фон остаются на месте.

Пожилой человек или старое фото

  • Бабушка улыбается и смотрит в камеру. Лёгкое моргание, плечи слегка двигаются при дыхании. Остальное неподвижно.

Ребенок

  • Ребёнок смеётся и машет рукой в камеру. Движения плавные, камера не двигается.

Питомец

  • Кот поворачивает голову к окну и медленно моргает. Хвост слегка двигается. Камера неподвижна.
  • Собака поднимает голову и виляет хвостом. Уши слегка двигаются.

Если лицо искажается, добавьте в конец Лицо без изменений, движения очень плавные. Если модель хуже понимает русский, замените промт на английский. Например: «The woman smiles slightly and slowly turns her head to the camera. Blinks softly. The background stays still».

Что в итоге

Чтобы получилось хорошее видео, нужны чёткое фото, подходящая модель и короткий промт, где описано движение. Если хотите, чтобы человек на фото заговорил, выберите модель, которая сама создаёт звук. Либо оживите фото и добавьте озвучку отдельно. Для начала возьмите один портрет и сделайте ролик на несколько секунд. Посмотрите на результат и меняйте промт или модель, пока не получится то, что нужно.

Открыть статьи
08 октября 2026 г.

Как улучшить качество видео до 4K: генерируем в 480p и делаем апскейл

Видео в высоком разрешении генерировать дороже и дольше. Если ролик не получился с первого раза, а так бывает почти всегда, вы платите за каждую попытку полную цену. Есть способ проще. Сначала делаете ролик в 480p, выбираете удачный вариант и только его доводите до хорошего качества. Для этого на Syntasy.pro есть отдельное приложение «Улучшить видео».

02 октября 2026 г.

Как сделать серию стикеров или эмодзи с одним персонажем

Один красивый стикер сделать несложно. Трудности начинаются на втором: персонаж меняет форму головы, цвет шапки и толщину линий, и набор перестаёт выглядеть единым. В workflow как раз поможет строить серию вокруг одного эталонного изображения.

02 октября 2026 г.

Как использовать языковую модель внутри workflow, чтобы она сама писала промпты для изображений и видео

Хороший промпт для изображения или видео занимает несколько предложений: сюжет, ракурс, свет, стиль, детали, ограничения. Если делать ролик из пяти сцен, писать такие тексты вручную долго, и к четвёртой сцене формулировки уже расходятся со стилем первой. Языковую модель можно поставить в начало workflow, и тогда она превращает короткую идею в готовые промпты, которые сразу уходят в ноды генерации.