КАДР

Как оживить фотографию нейросетью: пошагово, с примерами и ценами

Ален основатель КАДР Обновлено 2026-07-12 6 мин чтения

Чтобы оживить фотографию, нужна видеомодель в режиме image-to-video: вы загружаете снимок как стартовый кадр и текстом описываете, что должно двигаться. Модель достраивает следующие кадры от вашей картинки. Стоит это от 46 до 324 рублей за один ролик в зависимости от модели (данные КАДР, июль 2026). Главное правило: описывайте только движение, а не то, что и так видно на фото. Ниже разбираем, какие модели справляются лучше, как оживить старое семейное фото и почему у людей на видео «плывёт» лицо.

Что такое image-to-video

Есть два способа получить видео от нейросети. Первый, text-to-video: вы описываете сцену словами, и модель придумывает её с нуля. Второй, image-to-video: вы даёте готовое изображение, и модель достраивает от него движение.

Второй способ почти всегда даёт более предсказуемый результат, и вот почему. Когда вы описываете кадр словами, модель сама решает, как выглядят люди, свет, обстановка. Когда вы даёте фотографию, всё это уже задано. Ей остаётся только придумать, что будет через секунду.

Отсюда следует главное правило.

Правило: описывайте движение, а не картинку

Самая частая ошибка выглядит так. Человек загружает фото девушки в кафе и пишет промпт: «девушка с тёмными волосами сидит в кафе за столиком, на столе чашка кофе, тёплый свет».

Модель это уже видит. Вы только что пересказали ей содержимое картинки и не сказали ничего полезного.

Правильный промпт описывает то, чего на фото нет: движение.

Девушка медленно поднимает чашку и делает глоток, пар поднимается вверх, за окном проезжает машина, камера медленно наезжает.

Всё. Внешность, свет и обстановка берутся из фотографии. Ваше дело сказать, что оживает.

Более того, описание внешности при наличии фото вредит: текст начинает конфликтовать с картинкой, и модель ищет компромисс между тем, что видит, и тем, что читает. В результате лицо уплывает.

Как задавать движение

Движение в кадре бывает двух типов, и описывать нужно оба.

Что двигается в сцене. Волосы на ветру, пар над чашкой, листва, вода, дым, моргание, лёгкий поворот головы, движение руки.

Что делает камера. Тут работает язык кинематографистов, и модели его понимают:

  • медленный наезд (dolly in),
  • отъезд (dolly out),
  • проезд вбок (truck),
  • панорама с поворотом (pan),
  • облёт вокруг объекта (orbit),
  • подъём камеры (crane up).

Комбинация «мягкое движение в сцене плюс медленное движение камеры» почти всегда выглядит хорошо. Комбинация «резкое движение объекта плюс быстрая камера» почти всегда разваливается.

Правило меньшего движения

Чем больше вы просите, тем выше шанс, что модель сломает изображение.

Просите минимум. Один поворот головы вместо разворота всего тела. Моргание вместо смены выражения лица. Медленный наезд вместо облёта. Скромное движение на статичном красивом кадре выглядит дороже, чем размашистое движение с поехавшей анатомией.

Если один и тот же герой должен появляться в нескольких роликах, вам понадобится консистентность персонажа. Особенно это касается людей. Лицо это то, где мозг зрителя замечает малейшую фальшь. Пять секунд, где человек просто дышит и моргает, работают. Пять секунд, где он встаёт и идёт, чаще всего нет.

Отдельный случай: старые семейные фотографии

Один из самых частых и самых трогательных сценариев. Работает, но требует подготовки.

Сначала почините снимок. Модель считывает ровно то, что видит. Если на исходнике царапины, зерно и размытое лицо, на видео вы получите движущиеся царапины и плывущее лицо. Перед оживлением стоит прогнать фото через модель редактирования: убрать повреждения, поднять резкость, при необходимости увеличить разрешение.

Просите минимальное движение. Лёгкая улыбка, моргание, едва заметный поворот головы, очень медленный наезд камеры. Не просите человека встать, повернуться или заговорить.

Будьте готовы к отбраковке. Лица на старых фото чаще всего мелкие и нечёткие, поэтому попыток понадобится больше обычного. Гоняйте черновики в низком разрешении.

И честное предупреждение. Результат почти всегда получается похожим, но не идентичным. Это не ваш дедушка, это нейросетевая интерпретация его фотографии. Для многих это трогательно, для кого-то тревожно. Стоит понимать заранее.

Почему модель может просто отказать

Отдельная ситуация, которая застаёт врасплох: вы загружаете фото человека, жмёте генерацию и получаете отказ.

Это не сбой. Это фильтр модерации. Разработчики моделей боятся, что их инструментом будут делать дипфейки, поэтому встраивают защиту, которая срабатывает на реалистичные фотографии людей. Проверить, ваша это фотография или чужая, модель не может, поэтому отказывает на всякий случай.

Политики у разработчиков разные, и это ключевой момент. Например, у Seedance 2.0 в описании прямо сказано, что она не подходит для фотографий реальных людей: модель отлично оживляет предметы, животных и сгенерированных персонажей, но на живом лице упрётся в фильтр. При этом та же фотография может спокойно пройти в Veo, Kling или Hailuo.

Что делать:

  • Смените модель. Самое простое и самое рабочее. Отказ у одной не означает отказ у всех.
  • Не обходите фильтр. Переформулировки в духе «это не настоящий человек» не работают и рискуют блокировкой аккаунта.
  • Уберите триггеры из промпта. Иногда отказ вызывает не фото, а формулировка: упоминания имён, знаменитостей, речи.

Именно поэтому доступ к нескольким моделям в одном окне экономит время: не нужно заводить пять аккаунтов, чтобы выяснить, какая согласится.

Какую модель выбрать

Цены на КАДР, ролик 6 секунд, 1080p, звук выключен, июль 2026.

Модель Цена, руб. Сильная сторона
Google Veo 3.1 Lite 46 самая дешёвая, для черновиков и простых сцен
Seedance 1.5 Pro 55 мягкое движение, портреты, массовые прогоны
Google Veo 3.1 Fast 92 хорошее качество за небольшие деньги
Kling Video O1 142 выраженное движение камеры
Kling v3.0 Pro 142 люди, сложная динамика
Seedance 2.0 324 флагман, стабильный персонаж, до 4K

Не является публичной офертой.

Развёрнутый расчёт стоимости по всем моделям есть в статье сколько стоит минута AI-видео. Универсального лидера нет. Если оживляете портрет с мягким движением, начните с линейки Seedance. Если нужен эффектный облёт камеры, пробуйте Kling. Если просто экспериментируете, берите Veo 3.1 Lite и не жалейте попыток.

Где сэкономить

Разрешение. Тот же ролик на Seedance 2.0 стоит 65 рублей в 480p и 324 рубля в 1080p. Пятикратная разница. Подбирайте движение в низком разрешении, финал делайте в высоком.

Звук. Если человек на фото не говорит, звук из модели вам не нужен, а он удваивает цену. Выключайте.

Длительность. Начинайте с коротких роликов. Если движение не работает на 5 секундах, на 10 оно не станет лучше, только дороже.

Пять ошибок

  1. Пересказ фотографии в промпте. Модель видит картинку. Описывайте движение, а не содержимое.
  2. Слишком много движения. Чем сильнее движение, тем выше шанс, что анатомия поедет.
  3. Плохой исходник. Размытое или мелкое лицо на входе означает поехавшее лицо на выходе.
  4. Описание внешности при наличии фото. Текст конфликтует с изображением, получается третий человек.
  5. Финальное качество с первой попытки. Вы платите впятеро дороже за проверку идеи.

Коротко

Оживление фото это режим image-to-video: фотография как стартовый кадр плюс текстовое описание движения. Не пересказывайте картинку, описывайте только то, что должно двигаться, и просите минимум. Черновики гоняйте в 480p на дешёвой модели, звук выключайте, если никто не говорит.

Для старых семейных снимков сначала почините исходник, потом оживляйте, и просите совсем немного движения.

Частые вопросы

Как оживить фото нейросетью?
Загрузите фотографию в видеомодель как стартовый кадр и текстом опишите движение: что двигается в кадре и как ведёт себя камера. Модель достроит следующие кадры от вашего изображения. Описывать содержимое фото не нужно, модель его видит.
Сколько стоит оживить одну фотографию?
От 46 рублей на Veo 3.1 Lite до 324 рублей на флагманском Seedance 2.0 за ролик 6 секунд в 1080p (данные КАДР, июль 2026). В низком разрешении те же ролики дешевле примерно в пять раз, поэтому черновики выгодно гонять там.
Можно ли оживить старую семейную фотографию?
Да, и это один из самых частых сценариев. Лучше сначала улучшить снимок: убрать царапины и шум, поднять резкость. Модель считывает то, что видит, и если лицо на исходнике размыто, на видео оно будет плыть. Движение стоит просить минимальное: лёгкий поворот головы, моргание, медленный наезд камеры.
Почему у человека на оживлённом фото искажается лицо?
Три причины. Лицо на исходнике слишком мелкое или размытое, вы просите слишком сильное движение, или вы описали внешность словами, и текст начал конфликтовать с фотографией. Просите меньше движения и не описывайте то, что уже есть на снимке.
Какая нейросеть лучше оживляет фото?
Для выраженного движения камеры сильнее Kling, для мягкого движения и дешёвых экспериментов подойдёт Veo 3.1 Lite. Важный нюанс: Seedance 2.0 отлично оживляет предметы и сгенерированных персонажей, но для фотографий реальных людей она не предназначена и может отказать в генерации.
Почему нейросеть отказывается оживлять фото человека?
Срабатывает фильтр модерации: разработчики блокируют работу с реалистичными фото людей, чтобы их инструментом не делали дипфейки. Политики у моделей разные, поэтому отказ у одной не означает отказ у всех. Например, Seedance 2.0 прямо не рассчитана на реальные лица, а Veo или Kling ту же фотографию могут принять.
Можно ли заставить человека на фото говорить?
Да, для этого нужен липсинк: модель с нативным звуком синхронизирует движение губ с речью. Учтите, что включённый звук удваивает стоимость генерации, а качество русской артикуляции у моделей заметно хуже, чем английской.

Оживите своё фото

В КАДР можно загрузить фотографию и оживить её в любой из моделей: Seedance, Kling, Veo, Hailuo, Wan. Цена генерации видна до запуска, есть выбор разрешения и длительности. Оплата рублями с российской карты, токены не сгорают.

Попробовать
Ален
Основатель КАДР. 5 лет в автоматизации, больше 50 проектов. Подключал модели генерации напрямую через API, поэтому цены в статье это не пересказ чужих обзоров.