Оживить фото нейросетью — значит заставить статичный кадр двигаться: добавить лёгкую улыбку, поворот головы, синтезированную речь или полное движение всей сцены. Сегодня, чтобы оживить фото, нейросеть берёт одну картинку и короткое текстовое описание движения, а на выходе выдаёт короткий клип длиной 5–15 секунд. В 2026 году для этого не нужны навыки монтажа или актёры — достаточно браузера.
По состоянию на август 2026 года задачу принято делить на три режима: анимация лица (мягкая мимика и поворот головы), «говорящее фото» с синхронизацией губ под аудио (lip-sync) и полноценный image-to-video, где двигается задний план и объекты. Лидеры рынка — Runway Gen-4.5, Kling 3.0, Pika 2.2, семейство MiniMax Hailuo и Sora от OpenAI; для говорящих портретов — Hedra и D-ID. Часть сервисов ограничивает доступ из России, поэтому Яндекс (YandexART) и Сбер (Kandinsky) остаются рабочими вариантами без VPN, а AgentHere предлагает генерацию видео через маркетплейс агентов и навыков с оплатой в рублях.
Какие бывают способы оживить фото нейросетью?
Перед тем как выбирать модель, важно понять разницу между тремя режимами анимации — они решают разные задачи и по-разному смотрятся на выходе.
- Анимация лица (face animation). Модель добавляет естественную мимику: моргание, лёгкую улыбку, поворот головы, дыхание. Сцена при этом почти неподвижна — двигается только человек. Это классический приём для семейных архивов и портретной съёмки, популяризованный ещё сервисами вроде Deep Nostalgia, а сейчас доступный в Runway, Hailuo и Kandinsky.
- Говорящее фото (talking head / lip-sync). Вы загружаете портрет и аудио (или вводите текст, который озвучивает синтезатор), а модель синхронизирует движение губ с речью. Эталонные инструменты здесь — Hedra с моделью Character-3 и D-ID Creative Reality Studio; Viggle дополнительно переносит движение всего тела с опорного ролика.
- Полный image-to-video. Двигается вся сцена: камера, фон, объекты, физика. Из одного фото получается кинематографичный фрагмент. Этим занимаются Runway Gen-4.5, Kling 3.0, Pika 2.2 и Hailuo.
Эффект и выбор модели удобно сверять по матрице «задача → инструмент». Ниже — ориентир на август 2026 года; детали и длительности подтверждены в документации вендоров.
| Эффект | Подходящие модели (2026) | Типичная длина клипа | Источник |
|---|---|---|---|
| Анимация лица, мимика | Runway Gen-4.5, Hailuo (MiniMax H3), Kandinsky 6.0 | 5–10 с | Runway, Hailuo, Сбер |
| Говорящее фото (lip-sync) | Hedra Character-3, D-ID, Viggle | 10–60 с | Hedra, D-ID, Viggle |
| Полное движение, image-to-video | Runway Gen-4.5, Kling 3.0, Pika 2.2, Hailuo | 5–15 с | Runway, Kuaishou, Pika |
| Стилизация, эффекты для Reels/Shorts | Pika (Pikaframes, Pikaffects), Viggle | 5–10 с | Pika, Viggle |
Совет: сначала определите, что именно должно двигаться — только лицо, губы под текст или вся сцена. От этого зависит класс модели, а не бренд. Гоняться за «самой мощной» нейросетью ради лёгкой улыбки на портрете бессмысленно — для этого хватит и бесплатного российского сервиса.
Какие модели лидируют в 2026 году и чем они отличаются?
Рынок image-to-video обновляется каждые несколько месяцев, поэтому стоит смотреть на конкретные поколения моделей, а не на «волшебный сервис». Вот расклад по ключевым игрокам на август 2026 года.
<!-- ИНФОГРАФИКА: Сравнительная таблица моделей image-to-video: Runway Gen-4.5 (5–10 с), Kling 3.0 (до 15 с, 1080p), Pika 2.2, Hailuo/MiniMax H3, Sora, Hedra Character-3, плюс российские YandexART и Kandinsky 6.0 -->Runway Gen-4.5 — флагманская модель студии Runway для image-to-video с упором на кинематографичность, реалистичную физику и точное следование промпту. Согласно справке вендора, клипы на основе изображения длятся 5, 8 или 10 секунд в диапазоне 2–10 секунд; есть версия Turbo для ускоренной генерации (Runway, help-центр). Kling 3.0 от Kuaishou — единая мультимодальная модель, которая нативно объединяет text-to-video, image-to-video, reference-to-video и внутрикадровый монтаж; клипы доходят до 15 секунд при 1080p (Kuaishou IR). Pika 2.2 делает image-to-video до 10 секунд в разрешении до 1080p и добавляет режимы Pikaframes и Pikaffects для эффектов и переходов (Pika). Семейство MiniMax Hailuo (актуальная H3, широко доступна версия 2.3) превращает фото в ролики 6–10 секунд с естественной мимикой человека (Hailuo). Sora от OpenAI генерирует клипы до 20 секунд и доступна через подписку ChatGPT и API (OpenAI).
Для говорящих портретов отдельная лига. Hedra Character-3 — омнимодальная модель lip-sync: один портрет плюс аудиофайл превращаются в говорящего персонажа с близкой к естественной артикуляцией; коммерческие тарифы стартуют от $15 в месяц (Hedra). D-ID через Creative Reality Studio собирает говорящих аватаров из фото, текста или аудио — продукт давно стал стандартом для корпоративных видео и презентаций (D-ID). Viggle идёт другим путём: его модель JST-1 переносит движение с опорного ролика на персонажа вашего фото, давая полноценную анимацию тела, а не только лица (Viggle).
В России без обходных средств работают отечественные модели. YandexART создаёт детализированные изображения и анимационные ролики по текстовому запросу и доступен бесплатно в приложении «Шедеврум» (Яндекс). Kandinsky от Сбера генерирует короткие видеоролики по описанию; по данным «Хабра», при запуске Kandinsky Video давал 10 пробных роликов без авторизации и до 10 роликов в день после неё (Хабр), а текущая версия линейки — Kandinsky 6.0 (РБК).
Сводное сравнение упростит выбор.
| Модель | Вендор | Режим | Длительность | Разрешение | Доступ из РФ (август 2026) |
|---|---|---|---|---|---|
| Runway Gen-4.5 | Runway | image-to-video | 5–10 с | до 1080p | ограничен, нужна иностранная карта |
| Kling 3.0 | Kuaishou | image-to-video | до 15 с | 1080p | ограничен |
| Pika 2.2 | Pika Labs | image-to-video | до 10 с | до 1080p | ограничен |
| Hailuo (MiniMax H3) | MiniMax | image-to-video | 6–10 с | — | ограничен |
| Sora | OpenAI | text/image-to-video | до 20 с | — | ограничен (ChatGPT, API) |
| Hedra Character-3 | Hedra | lip-sync | от 10 с | — | ограничен |
| D-ID | D-ID | talking avatar | от 10 с | — | ограничен |
| Viggle (JST-1) | Viggle | перенос движения | — | — | ограничен |
| YandexART | Яндекс | текст → анимация | короткие клипы | — | работает без VPN |
| Kandinsky 6.0 | Сбер | текст/изображение → видео | ~6 с | ~512 px | работает без VPN |
Как оживить портрет за 5 шагов: лёгкая улыбка и поворот головы
Разберём типовую задачу: есть чёткое портретное фото анфас, нужно получить 5-секундный клип с лёгкой улыбкой и плавным поворотом головы. Подойдёт любой режим анимации лица или image-to-video.
- Подготовьте исходник. Лицо должно быть хорошо освещено, видно оба глаза, разрешение — от 1024 px по длинной стороне. Для старых фото сначала сделайте реставрацию и раскрашивание — многие сервисы (в том числе российские) предлагают это одним запросом.
- Выберите режим. Для лёгкой мимики достаточно анимации лица (Hailuo, Kandinsky, Runway). Если важна cinematic-картинка и движение камеры — берите полный image-to-video (Runway Gen-4.5, Kling 3.0).
- Сформулируйте промпт. Опишите движение буквально: «l subtle smile, slow head turn to the right, natural blinking, soft camera push-in». Избегайте взаимоисключающих команд вроде «бегущий крупным планом портрет».
- Задайте длительность и соотношение сторон. Для соцсетей — вертикаль 9:16 и 5 секунд; для презентации — 16:9 и 10 секунд. Большинство моделей позволяют выбрать оба параметра.
- Сгенерируйте, отберите и при необходимости сшейте. Делайте 3–4 варианта и оставляйте лучший. Для говорящего фото отдельно синтезируйте аудио (например, через озвучку текста нейросетью) и подставьте в Hedra или D-ID.
Внимание: лицо реального человека — персональные данные. Получайте согласие на использование портрета родственника или клиента, особенно если ролик пойдёт в рекламу. Технически нейросеть обработает любое фото, но юридическая ответственность лежит на вас.
Если хочется быстрее и без возни с промптами на английском, можно собрать готовый сценарий под задачу: на платформе AgentHere есть агенты и навыки для генерации видео, которые сами подбирают модель, длительность и промпт, а оплачиваются в рублях. Сэкономленное время обычно важнее, чем разница в качестве между двумя топовыми моделями.
Как получить доступ из России без VPN и валютной карты?
Это ключевой практический вопрос. По состоянию на август 2026 года иностранные сервисы — Runway, Pika, Sora, Kling, Hailuo, Hedra, D-ID — ограничивают вход с российских IP-адресов и, как правило, принимают только иностранные банковские карты; для входа и оплаты требуются технические обходные средства, которые мы здесь не рекламируем и не описываем (РБК,Companies). Поэкспериментировать с зарубежными моделями можно в поездке или через зарубежных коллег, но для регулярной работы это неудобно.
Российские модели лишены этого недостатка. YandexART от Яндекса и Kandinsky от Сбера работают напрямую с российских IP и оплачиваются в рублях (либо бесплатны в рамках лимитов), интерфейс — на русском языке, регистрация — по телефону (Яндекс, Сбер). AgentHere идёт дальше: генерация изображения и видео доступна через маркетплейс агентов и навыков, с оплатой в рублях и без необходимости настраивать что-либо дополнительно. При регистрации даётся бонус 1 000 000 токенов, а закрытые иностранные модели часто подключены как инструменты внутри платформы — то есть технически вы работаете с тем же Runway или Hailuo, но через российского посредника, который берёт на себя доступ и оплату.
Ещё один плюс отечественного пути — рабочий стол. У десктоп-приложения AgentHere есть агенты для контента, которые объединяют генерацию изображения, видео и текста в одном окне; не нужно переключаться между десятком вкладок и тащить между ними файлы. Это удобно, когда нужно не разовое «оживить одно фото», а регулярная нарезка роликов для блога или соцсетей.
Под какие задачи выбирать ту или иную модель
Разные сценарии требуют разных инструментов — попробуем разложить по частым запросам.
- «Оживить старое фото» родственника или архивный кадр. Сначала реставрация и раскрашивание, затем мягкая анимация лица. Подойдёт Kandinsky (без VPN, на русском), Hailuo или Runway в режиме минимальной мимики. Главное — не переборщить с движением: старый портрет лучше смотрится с лёгким дыханием и морганием, чем с резким поворотом.
- «Говорящее фото» для видеоурока, презентации или подкаста. Нужен lip-sync: Hedra Character-3 для максимально естественной артикуляции или D-ID для быстрого корпоративного варианта. Текст озвучивается отдельно и подставляется как аудиодорожка.
- Короткий клип для Reels и Shorts. Здесь важны эффекты и темп: Pika с Pikaffects и Pikaframes даёт «вау-эффекты» и плавные переходы, Viggle переносит танцевальное движение с референса на ваше фото. Сценарий ролика удобно заранее прописать нейросетью — см. гайд по сценариям для Reels и Shorts.
- Кинематографичный фрагмент из пейзажа или натюрморта. Полный image-to-video: Runway Gen-4.5 для камеры и физики, Kling 3.0 для длины до 15 секунд, Hailuo для мягкого движения. Подробнее о генерации видео вообще — в обзоре генерации видео нейросетью в 2026 году.
Главное правило: двигайте только то, что должно двигаться. Избыточная анимация (едет фон, летит камера, морфирует лицо) выдаёт «нейросетность» ролика и портит впечатление. Чем сдержаннее промпт — тем профессиональнее результат.
Больше о выборе моделей в смежных областях — в подборках лучших нейросетей июля 2026 года и нейросетей для генерации изображений: там разобран текст-в-картинку, который часто предшествует оживлению.
FAQ
Можно ли бесплатно оживить старое чёрно-белое фото?
Да. Сбер даёт бесплатные лимиты на Kandinsky — на старте 10 роликов без авторизации и до 10 в день после входа (Хабр); YandexART доступен бесплатно в «Шедевруме» (Яндекс). AgentHere при регистрации начисляет бонус 1 000 000 токенов, который можно потратить на генерацию. Для глубокого реставрации ч/б снимка иногда требуется отдельный шаг раскрашивания перед анимацией.
Какая нейросеть делает лучшее «говорящее фото»?
По состоянию на август 2026 года лидером по качеству lip-sync считается Hedra Character-3: модель строит артикуляцию на фонемном анализе и удерживает синхронизацию губ даже крупным планом (Hedra). Для корпоративных аватаров и быстрого результата чаще выбирают D-ID. Если нужно движение всего тела, а не только лица, берут Viggle.
Сколько секунд видео получается из одного фото?
У большинства моделей — короткий клип: Runway Gen-4.5 даёт 5–10 секунд, Kling 3.0 — до 15 секунд, Pika 2.2 и Hailuo — 6–10 секунд, Sora — до 20 секунд. Этого хватает для Reels/Shorts, заставки или фрагмента презентации. Для более длинного ролика клипы сшивают в монтаже.
Какое разрешение выходит на выходе?
Топовые зарубежные модели выдают до 1080p (Kling 3.0, Pika 2.2, Runway). Российский Kandinsky в базовом режиме генерирует ролики около 512 px по длинной стороне (РБК) — этого достаточно для соцсетей, но мало для большого экрана. Для повышения чёткости используют отдельные апскейлеры.
Законно ли использовать ролик с лицом реального человека?
Изображение лица — охраняемые персональные данные. Для личного архива достаточно согласия родственника в разговоре; для публикации, рекламы или монетизации нужно явное согласие человека, чьё лицо оживили. Сторонние знаменитости — отдельный риск: их внешность может дополнительно защищаться правом на изображение. Технически нейросеть обработает любой кадр, ответственность за использование лежит на вас.
Что дальше
Чтобы оживить фото нейросетью в 2026 году, определите режим (мимика, говорящее фото или полный image-to-video), выберите модель под задачу и помните про доступ из России: отечественные YandexART, Kandinsky и AgentHere работают напрямую, иностранные Runway, Pika, Kling, Hailuo и Sora — с ограничениями. Самый быстрый старт — собрать рабочий процесс под одну задачу и не прыгать между сервисами.
Попробуйте готового агента для контента и видео на платформе AgentHere: галерея агентов, маркетплейс навыков и скачивание десктоп-приложения. Новым пользователям доступен бонус 1 000 000 токенов при регистрации — этого хватит, чтобы оживить десятки фотографий и собрать первый ролик от начала до конца.
Источники
- Runway Gen-4.5: State-of-the-Art AI Video Generation — https://runwayml.com/research/introducing-runway-gen-4.5
- Creating with Gen-4.5 (справка Runway, длительности image-to-video) — https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5
- Kling AI Launches 3.0 Model (Kuaishou IR) — https://ir.kuaishou.com/news-releases/news-release-details/kling-ai-launches-30-model-ushering-era-where-everyone-can-be
- Kling AI — официальный сайт — https://kling.ai/
- Pika — идея в видео, image-to-video — https://pika.art/
- Hailuo AI (MiniMax H3) — image-to-video из фото — https://hailuoai.video/
- Sora is here (OpenAI) — https://openai.com/index/sora-is-here/
- Hedra Character-3 — модель lip-sync — https://www.hedra.com/models/video/hedra/character-3
- Hedra: AI Lip Sync Guide (tariffs from $15/mo) — https://www.hedra.com/uses/ai-talking-avatar
- D-ID Creative Reality Studio — https://www.d-id.com/
- Viggle AI — перенос движения на персонажа фото — https://viggle.ai/
- YandexART — нейросеть Яндекса — https://ya.ru/ai/art
- Сбер Kandinsky — генерация изображений и видео — https://www.sberbank.ru/ru/person/kandinsky
- Хабр: Сбер открыл доступ к Kandinsky Video (лимиты) — https://habr.com/ru/companies/sberbank/articles/957136/
- РБК: Сбер представил обновлённую модель Kandinsky 6.0 — https://www.rbc.ru/rbcfreenews/69f05af09a7947e6b38ed5ef
- РБК, Companies: Как оживить старое фото нейросетью — 5 сервисов для анимации (доступ из РФ) — https://companies.rbc.ru/news/0p3BQ4dCU3/kak-ozhivit-staroe-foto-nejrosetyu-5-servisov-dlya-animatsii-v-2026-godu/