Фото и видео
Как оживить фото нейросетью: 7 сервисов, 3 из них российских
За семь недель после запуска Veo 3 люди собрали 40 миллионов роликов, и с 10 июля 2025 года в это же окно можно загрузить свою фотографию: снимок превращается в клип на восемь секунд со звуком. У российского Шедеврума та же работа делается кнопкой и стоит 0 ₽, только ролик выходит на четыре секунды
Оживление фото - это когда неподвижный снимок превращают в короткий ролик: человек на фотографии моргает и поворачивает голову, пар над чашкой поднимается, камера медленно отъезжает назад. Технически это работа видеогенератора: нейросеть берёт вашу картинку как первый кадр и дорисовывает следующие несколько десятков кадров сама. Никакой съёмки, никакого монтажа, только исходный снимок и одна фраза о том, что должно двигаться
Через двадцать минут у вас будет ролик из собственного снимка, понимание, какие фотографии для этого годятся, и цифры, чтобы не удивляться списанию. Отдельно разберём звук: с июля 2025 года Gemini делает из фотографии восьмисекундный клип сразу с озвучкой
Оживить фото - это загрузить снимок в видеогенератор и получить из него ролик на 4-8 секунд. В Шедевруме это делается эффектом движения и стоит 0 ₽, в Kling и Runway - кредитами с тарифа, в Gemini ролик выходит со звуком. Длиннее одной сцены за раз не выходит: дальше ролик продлевают отдельно
Что значит «оживить фото» и что получится на выходе
На выходе получится короткий видеофайл, обычно 4-8 секунд, который можно выложить в ленту или отправить в мессенджер. Не гифка, не слайдшоу с эффектом приближения, а настоящее видео, где объекты на снимке двигаются самостоятельно
Работает это так. Вы отдаёте генератору одну картинку, и она становится первым кадром будущего ролика. Дальше модель достраивает то, чего на снимке физически нет: как выглядит затылок человека, который повернулся, что было за спиной, куда ушла рука. Представьте художника, которому показали одну фотографию и попросили дорисовать следующие сто картинок с той же сценой. Он справится с тем, что видел, и начнёт выдумывать там, где не видел ничего
Отсюда растёт всё поведение жанра. Спокойное движение выходит достоверным, потому что дорисовывать почти нечего. Резкий поворот, взмах руки, поднятая ко рту чашка требуют выдумывать много, и вот там и появляются лишние пальцы и поехавшие черты лица
Тремя словами разница между соседними жанрами выглядит так, и её стоит держать в голове, иначе легко искать функцию не там
| Что нужно | Как это называется | Куда идти |
|---|---|---|
| Снимок начал двигаться, вышло видео | Оживление, оно же «фото в видео» | Эта статья |
| Снимок стал чётче, убраны царапины | Реставрация и улучшение качества | Инструменты обработки снимков |
| По снимку сделана другая картинка | Генерация изображения по образцу | Графические нейросети |
| Из снимка вырезан фон или объект | Обработка фото | Задачи по фото одним списком |
Таблица прокручивается вбок →
Ещё одна вещь, которая экономит нервы на старте: за одну попытку выходит короткая сцена, а не фильм. Четыре секунды у Шедеврума, пять секунд по умолчанию в окне Kling, восемь у Gemini. Дальше ролик либо продлевают отдельной кнопкой, либо склеивают из нескольких кусков, и это уже другая работа, она разобрана в материале как сделать видео с помощью ИИ
Шаг 0. Что нужно до старта
Нужны три вещи, и ни одна из них не про технику. Первое - сам снимок в приличном разрешении, лучше прямо из галереи телефона, а не пересланный в мессенджере и ужатый до неузнаваемости. Второе - аккаунт в одном из сервисов ниже. Третье - понимание, какое движение вы хотите увидеть, одной фразой
Что увидишь: в Kling, Luma, Runway, Gemini, Алисе и Kandinsky - шести сервисах из семи - экран устроен одинаково. Слева или сверху окно для загрузки картинки, под ним пустое поле для текста, внизу кнопка запуска. Если вы видите такой набор - вы там, где надо. У Шедеврума порядок другой: кадр не загружается с телефона, а выбирается из уже созданного или опубликованного в профиле, подробности в разделе про Шедеврум ниже
Что это даёт: у шести сервисов с окном загрузки вся работа сводится к трём одинаковым действиям что в российском приложении, что в зарубежном браузере. Загрузил, описал движение, нажал кнопку
Отдельно про среду. Эта статья нигде не просит открывать окно для команд и ничего не устанавливать на компьютер: всё делается в браузере или в приложении на телефоне. Если по ходу дела захочется собирать такие вещи пачками и по своим правилам, понадобится окно, где задачи пишут обычными словами, а не кнопками, и вот как поставить себе такое окно за вечер
Шаг 1. Выбери снимок, который вообще оживёт
Начинается всё не с сервиса, а с выбора кадра, и это единственный шаг, который решает половину результата. Модель дорисовывает то, чего не видела, поэтому чем меньше ей придётся выдумывать, тем достовернее выйдет ролик
Куда нажать: открой галерею и отбери три кандидата по правилу «один герой, лицо видно целиком, руки не перекрывают друг друга»
Что увидишь: годный кадр выглядит скучновато и статично, и это правильный признак. Портрет анфас, чашка на столе, пейзаж с водой, спящий кот. Плохой кандидат наоборот бодрый: групповое фото, где лица размером с ноготь, снимок в движении со смазом, кадр против солнца
Что это даёт: вы отсеиваете брак до того, как потратили на него попытку. У платных сервисов каждая попытка стоит кредитов, и отбор кадра - самая дешёвая экономия из возможных
| Снимок | Что будет | Почему |
|---|---|---|
| Портрет анфас, лицо крупно | Выходит достоверно почти всегда | Модель видит все черты и достраивает мелкое движение |
| Пейзаж, вода, облака, огонь | Выходит достоверно | Природа двигается неповторяющимся образом, ошибку не видно |
| Чашка, свеча, еда, предметный кадр | Выходит достоверно | Пар и блики выдумываются свободно, эталона нет |
| Групповое фото, лица мелкие | Ломается у второго плана | На мелком лице не хватает пикселей, модель домысливает черты |
| Руки в кадре, пальцы переплетены | Ломается чаще всего | Пальцы перекрывают друг друга, порядок восстановить неоткуда |
| Надпись на одежде, вывеска, текст | Буквы поплывут | Модель рисует похожие на буквы значки, а не ваш текст |
| Снимок со смазом, тёмный, мелкий | Ролик выйдет мутным | Первый кадр задаёт качество всему ролику |
Таблица прокручивается вбок →
Половина дела сделана: кадр отобран, и дальше ошибиться станет заметно труднее
Шаг 2. Загрузи фото в окно генератора
Дальше три коротких действия, и они одинаковы у Kling, Luma и Runway. Разница только в подписях кнопок
От пустого экрана до загруженного кадра
- Открой раздел, где делают видео из картинки у Kling это вкладка
Video Generationв верхней части экрана, у Gemini - пунктVideoв панели инструментов под полем ввода. Увидишь пустую рамку с подписью про добавление кадра. Это значит, что сервис ждёт именно картинку, а не текст - Нажми рамку загрузки и выбери снимок у Kling рамка подписана
Add start and end frames, то есть «добавь первый и последний кадр». Второй кадр не обязателен: загрузи только первый, и модель сама придумает, куда двигаться. Увидишь свою фотографию в маленьком окошке вместо пунктирной рамки - Проверь, что фотография встала в первый кадр, а не в справочную картинку у некоторых сервисов рядом есть второе поле для образца стиля. Если снимок ушёл туда, ролик получится про что-то другое. Увидишь подпись под окошком: там должно быть про первый кадр, а не про образец или референс
Что это даёт: с этой секунды сервис работает не с абстрактной фантазией, а с вашей фотографией, и всё, что вы напишете дальше, применится именно к ней
Если вместо окошка с фотографией появилось сообщение об ошибке загрузки, дело почти всегда в размере или формате файла. Пересохрани снимок как обычный jpg с телефона и попробуй снова, это нормально и ничего не сломалось
Шаг 3. Напиши одно движение вместо длинного сценария
Описание движения - это одна фраза из трёх кусков: что на снимке, одно действие, поведение камеры. Больше в четыре секунды не помещается физически, и попытка написать сценарий на абзац делает результат хуже, а не лучше
Куда нажать: поле для текста под загруженной картинкой, там же, где серая подсказка про описание сцены
Что увидишь: пока поле пустое, кнопка запуска у части сервисов остаётся бледной и не нажимается. Как только появился текст, она загорается
Что это даёт: вы задаёте модели рамку, за которую она не выйдет. Без рамки она сама решит, что должно двигаться, и решит обычно не то
Разработчики Luma в своём руководстве формулируют требование к описанию прямо: «Describe what you want in natural, detailed language», то есть обычными подробными словами, а не набором ключевиков через запятую. Русский язык точно понимают Kling - в подсказке под полем ввода написано «Support multiple languages, dialects and accents» - и Шедеврум, который прямо пишет, что описание вводится на любом языке мира. За Luma, Runway, Gemini, Алису и Kandinsky на этот счёт официально никто не ручается: если ответ вышел не тем, что просили, разумно продублировать описание по-английски
| Кусок фразы | Что писать | Пример |
|---|---|---|
| Что на снимке | Коротко, кто или что в кадре | Пожилая женщина в синем платке |
| Одно действие | Одно, спокойное, глаголом | Медленно улыбается и моргает |
| Поведение камеры | Куда едет камера или что она стоит | Камера медленно приближается |
Таблица прокручивается вбок →
Собранная фраза выглядит так: «Пожилая женщина в синем платке медленно улыбается и моргает, камера медленно приближается». Тридцать слов на этом месте дадут дёрганый ролик, где всё двигается одновременно
Отдельный приём, который экономит попытки: сначала запросите вообще минимум. «Лёгкое дыхание, глаза моргают, камера неподвижна». Если такой ролик вышел чистым, добавляйте движение по одному кусочку. Если сразу написать пять действий и получить брак, вы не поймёте, какое из пяти его вызвало
Шаг 4. Выбери длину, качество и запусти
Под полем ввода живёт строка формата, и в ней стоит вся техника ролика. У Kling она выглядит как 720p · 5s · 16:9 · 1 и читается слева направо: качество картинки, длина в секундах, форма кадра, сколько роликов сделать за раз
Куда нажать: сама строка формата, она раскрывается в список
Что увидишь: четыре переключателя. Разрешение (насколько чёткая картинка), длительность (сколько секунд), соотношение сторон (вертикальный кадр для ленты или горизонтальный для экрана), количество вариантов за одну попытку
Что это даёт: каждый переключатель напрямую двигает цену. Больше секунд, выше разрешение и больше вариантов за раз - больше списанных кредитов. Первую попытку разумно делать на минимальных значениях: посмотреть, туда ли поехало движение, и только потом поднимать качество
Три переключателя, которые двигают цену
- Длительность минимум обычно 5 секунд. Пока вы проверяете идею, длинный ролик не нужен: движение либо поехало правильно, либо нет, и видно это на первой секунде
- Разрешение ставь самое низкое из доступных на пробах. Kling отдаёт 1080p и 4K только на платных тарифах, и на черновых попытках эта чёткость просто сгорает вместе с кредитами
- Количество вариантов за попытку бесплатный тариф Kling делает 1 ролик за раз, платные до 4. Четыре варианта разом полезны, когда фраза уже отлажена, и расточительны, когда вы ещё подбираете слова
Дальше кнопка запуска, у Kling она называется Generate, у Шедеврума - «Создать видео». Ролик считается от нескольких десятков секунд до нескольких минут, всё это время окно можно не держать открытым
Готово: у вас первый ролик из собственного снимка. Осталось разобраться, сколько это стоит и что делать с поехавшим лицом
Как оживить фото в Шедевруме: восемь эффектов движения
Шедеврум оживляет картинку эффектом движения, и это самый простой вход для человека без зарубежной карты. Приложение Яндекса, интерфейс на русском, ролик выходит длиной 4 секунды с частотой 24 кадра в секунду. Справка Яндекса даёт разницу между четырьмя моделями: v.1 двигает камеру, v.2 двигает объекты в кадре, v.3 даёт меньше дефектов, а Frame Pack, о котором ниже, открыт по подписке
Про оживление уже опубликованной картинки в справке сказано дословно:
«Вы можете оживить опубликованные ранее изображения, если добавите эффект движения»
Яндекс, справка Шедеврума, раздел «Примеры», обращение 20.08.2026
Эффект движения - это готовый рецепт поведения камеры, выбранный кнопкой вместо описания словами. Похоже на фильтр в редакторе фотографий: вы не объясняете, что сделать с цветом, а нажимаете «тёплый» и получаете результат. Восемь таких рецептов, и все они названы по-русски
| Эффект | Что делает с кадром | Кому подойдёт |
|---|---|---|
| Зум | Приближение к центру снимка | Портрет, лицо крупно |
| Отдаление | Отъезд назад, кадр раскрывается | Пейзаж, интерьер |
| Панорама | Проезд вдоль сцены вбок | Широкий кадр, море, город |
| Подъём | Движение вверх | Здания, лес, вертикальные кадры |
| Вращение | Оборот вокруг предмета | Предметная съёмка, еда |
| Таймлапс | Ускоренная перемотка | Небо, облака, вода |
| Морфинг | Постепенное превращение | Абстрактные и рисованные кадры |
| Ручной | Движение и поворот камеры настраиваются по осям | Когда готовые рецепты не подошли |
Таблица прокручивается вбок →
Порядок действий в приложении отличается от зарубежных сервисов одной деталью: первый кадр вы не загружаете, а выбираете из четырёх предложенных вариантов, а эффект движения задаётся уже после этого
Оговорка перед шагами: маршрут ниже работает с картинкой, которая уже сделана или опубликована в самом Шедевруме - у неё есть тот самый «запрос», который вы скопируете на первом шаге. Личное фото из галереи телефона этим путём не оживить: загружать с телефона тут нечего, можно выбрать только между картинками, уже созданными в приложении. Для личного снимка - маршрут через Алису из следующего раздела (там загрузка своего фото подтверждена дословно) или любой из шести сервисов из таблицы дальше по статье
Оживление своей картинки в Шедевруме по шагам
- Зайди в профиль и открой нужную картинку увидишь её на весь экран и кнопку «Скопировать запрос» под ней. Это забирает то самое описание, по которому картинка была сделана, чтобы не набирать текст заново
- Внизу экрана нажми плюс и выбери «Видео» откроется пустое поле для описания и список моделей. Так вы переключаете приложение с картинок на ролики
- Вставь скопированное описание, нажми «Создать» и выбери один из четырёх вариантов первого кадра приложение предложит четыре варианта на основе твоего запроса. Так выбирается стартовая картинка ролика
- Выбери эффект движения и нажми «Создать видео» приложение предложит один из восьми готовых рецептов камеры, ролик соберётся за несколько минут и ляжет в профиль. С этого момента у тебя есть видеофайл, который можно сохранить и выложить куда угодно
Если вместо четырёх вариантов первого кадра приложение показало один и не даёт выбрать - вы, скорее всего, выбрали модель v.2 или v.3 вместо v.1. Вернитесь в список моделей и переключитесь на v.1: четыре варианта первого кадра и настройка камеры живут именно там
Модель Frame Pack в этом списке стоит особняком: она с открытым исходным кодом, сделана исследователями Стэнфордского университета, и доступна только по платной подписке. Первые 7 дней подписки бесплатны, дальше она стоит 100 рублей в месяц при наличии подписки Яндекс Плюс. Сам сервис рассчитан на взрослых: в справке прямо стоит отметка 18+, детям отведён отдельный режим
Три российских маршрута, где не нужна зарубежная карта
Российских входов в оживление три, и все три работают без зарубежной карты. Шедеврум, приложение Алиса AI и Kandinsky Video от Сбера
Приложение Алиса AI делает из картинки ролик длиной 4 секунды в разрешении 480p: на вход идут снимок и текстовое описание сюжета. Разрешение здесь заметно ниже, чем у остальных, поэтому маршрут годится посмотреть на жанр, а не собирать материал для ленты
Куда нажать: на странице функции кнопка «Скачать приложение», дальше внутри приложения загрузи своё фото и одной фразой опиши сюжет, по которому будет меняться картинка
Что увидишь: поле для загрузки фотографии и поле для описания сюжета. Если фраза не придумывается, готовые промты лежат примерами прямо на той же странице - «Дети отпускают шарики и радуются», «Бабочка машет крыльями, листочки двигаются»
Что это даёт: короткий ролик из своего снимка без зарубежной карты и без обходных путей - страница функции перечисляет условия тремя словами: быстро, без VPN, бесплатно
Kandinsky Video от Сбера умеет, по формулировке самой компании, оживлять загруженные изображения, и живёт внутри двух телеграм-ботов: GigaChat и Kandinsky. Лимит устроен щедро для проб: 10 роликов бесплатно на старте, после входа в аккаунт - по 10 видео каждый день, плюс десятка сверху за каждого приглашённого
Куда нажать: внутри любого из двух ботов - раздел меню «Создать видео»
Что увидишь: поле, куда отправляешь фотографию; расписывать промпт подробно не обязательно - сцену модель возьмёт из самой картинки
Что это даёт: готовый ролик прямо в чате бота, без выхода за пределы Telegram
| Маршрут | Длина ролика | Сколько стоит вход | Где живёт |
|---|---|---|---|
| Шедеврум | 4 секунды, 24 кадра в секунду | 0 ₽, часть моделей по подписке | Приложение Яндекса |
| Алиса | 4 секунды, 480p | 0 ₽ | Мобильное приложение |
| Kandinsky Video | Не публикуется | 10 роликов, дальше 10 в день | Телеграм-боты Сбера |
Таблица прокручивается вбок →
Честная оговорка про зарубежные сервисы. Работают ли Kling, Luma, Runway и Gemini из конкретного города и какой картой они оплачиваются - вопрос не к этой статье: способы оплаты разобраны отдельно в материале как оплатить нейросети из России, а здесь я говорю только о том, что напечатано на страницах самих сервисов
Сколько стоит оживить фото: кредиты вместо рублей
Платные видеогенераторы считают деньги не роликами, а кредитами. Кредит - это внутренний жетон сервиса: вы покупаете месячную пачку жетонов, а каждая генерация списывает из неё сколько-то штук
Вот здесь важная вещь, из-за которой многие статьи про цены оживления путают читателя. У Luma и у Runway цена одной попытки печатается дословно на странице тарифов: Luma на модели Ray3.2 в разрешении 720p списывает 100 кредитов за 5 секунд, а Runway на модели Gen-4.5 - 60 кредитов за те же 5 секунд. У Kling цены одной генерации на открытой странице нет: там показана только цена пакета, а сколько спишет конкретный ролик, видно уже в окне генерации после выбора длины и разрешения
Число привязано к модели, а не к сервису, и это стоит проверять каждый раз. На той же странице Luma у Veo 3.1 стоит 140 кредитов за секунду, а у Seedance 2.0 счёт идёт от 47 до 959 кредитов в секунду в зависимости от качества. За те же пять секунд это уже совсем другие деньги, поэтому в таблице на странице сервиса ищите строку своей модели, а не первую попавшуюся
В деньгах это выглядит так. Пачка Luma Plus стоит $30 за 10 000 кредитов, то есть кредит обходится в $0,003, а ролик Ray3.2 в 720p на 5 секунд - около $0,30, или ≈26 ₽ по курсу ЦБ 85,1293 на 20 августа 2026 года. У Runway на тарифе Standard $12 за 625 кредитов в месяц при годовой оплате, кредит стоит около $0,019, а ролик Gen-4.5 на 5 секунд - около $1,15, или ≈98 ₽. Сравнивать сервисы по цене пачки, как в таблице ниже, всё равно полезно: она показывает, во сколько обойдётся месяц активной работы, а не одна проба
Одна оговорка по колонке с ценой Kling, иначе таблица прочитается неправильно. Крупная цифра на карточке - это первый месяц по скидке, обычный прайс стоит рядом зачёркнутым ($10, $37, $92 и $180), а строка «Then» показывает списание со второго месяца. Строку «100 кредитов = столько-то» сервис считает именно от цены первого месяца: 6,99 доллара на 660 кредитов и дают те самые 1,06 за сотню. Со второго месяца сотня выходит дороже
| Сервис | Тариф | Кредитов в месяц | Цена тарифа | Что напечатано рядом |
|---|---|---|---|---|
| Kling AI | Standard | 660 | $6.99 первый месяц, дальше $8.8 | 100 кредитов = $1.06 |
| Kling AI | Pro | 3000 | $25.99 первый месяц, дальше $32.56 | 100 кредитов = $0.87 |
| Kling AI | Premier | 8000 | $64.99 первый месяц, дальше $80.96 | 100 кредитов = $0.81 |
| Kling AI | Ultra | 26000 | $127.99 первый месяц, дальше $159.99 | 100 кредитов = $0.49 |
| Runway | Free | 125 разовых | $0 | Пятигигабайтное хранилище |
| Runway | Standard | 625 | $12/мес | Без водяных знаков, апскейл до 4K |
| Runway | Pro | 2250 | $28/мес | Голоса для липсинка и озвучки, 500 ГБ хранилища |
| Runway | Max | 9500 | $76/мес | Неистраченные кредиты живут ещё месяц |
| Luma | Plus | 10 000 | $30/мес | Коммерческое использование разрешено |
| Luma | Pro | 40 000 | $90/мес | В 4 раза больше лимит на Luma Agents |
| Luma | Ultra | 150 000 | $300/мес | Все модели Luma и сторонние |
Таблица прокручивается вбок →
Разница между младшим и старшим тарифом Kling видна прямо на странице и считается делением: по цене первого месяца сотня кредитов на тарифе Standard стоит 1,06 доллара против 0,49 на тарифе Ultra, то есть на старшем тарифе тот же жетон обходится в 2,2 раза дешевле. Со второго месяца обе цифры подрастают - 1,33 и 0,62 доллара за сотню - а разница между тарифами держится та же. По курсу Центробанка 85,1293 рубля за доллар на 20 августа 2026 года первая пара выходит примерно 90 ₽ против 42 ₽ за сотню жетонов
Что из этого следует для новичка. Покупать старший тариф ради дешёвого жетона бессмысленно, пока вы не знаете, сколько роликов в месяц вам реально нужно. Первый месяц разумно прожить на бесплатных входах и на младшем тарифе, посчитать свои попытки и только потом решать
У Runway логика другая и для проб удобная: на бесплатном тарифе дают 125 разовых кредитов, не каждый месяц, а один раз на знакомство. На тарифе Max неиспользованные кредиты переносятся на следующий месяц, что для нерегулярной работы важнее размера пачки
Про водяной знак стоит знать заранее. У Kling снятие фирменной метки и коммерческое использование указаны только в платных карточках, у бесплатного тарифа в этих строках стоит прочерк. У Gemini метка ставится всегда: видимый водяной знак плюс невидимая цифровая метка SynthID, и от тарифа это не зависит
Что ломается на лицах, руках и надписях
Ломается всегда одно и то же, и список короткий: лица второго плана, пальцы, текст на одежде и вывесках, украшения и очки. Причина у всех четырёх случаев одна: модель достраивает то, чего на исходном снимке не видела
Разбирать поломки удобнее в том порядке, в каком их видно на готовом ролике
Четыре поломки по порядку проверки: почему ломается и чем лечится
- Открой ролик на полном увеличении и посмотри на лица второго плана они ломаются первыми: на мелком лице не хватает пикселей, и модель дорисовывает черты по своему усмотрению. Лечится кадрированием исходника: в кадре должен остаться один герой крупно, тогда домысливать модели почти нечего
- Останови ролик на середине и пересчитай пальцы пальцы перекрывают друг друга, и порядок восстановить неоткуда: модель не видела, какой из них за каким. Лечится выбором кадра, где руки лежат свободно, и описанием, в котором движение рук не заказано вовсе
- Прочитай надпись на одежде и вывеску на фоне вместо букв обычно выходят похожие на буквы значки: модель рисует форму текста, а не ваш текст. Само оживление надпись не сохраняет, зато её можно заказать отдельно - как именно, разобрано ниже в разделе «Словарь команд движения камеры»
- Посмотри на очки, серьги и мелкие блестящие детали в движении тонкая деталь с бликом есть на снимке в одном положении, и на повороте достраивать её не из чего. Лечится тем же, чем и всё остальное: чем спокойнее заказанное движение, тем меньше модели приходится выдумывать
Это не дефект конкретного сервиса и не следствие дешёвого тарифа. Публично производители признают эту границу редко, и единственное прямое признание лежит в соседней части жанра - в звуке. Google в описании Veo пишет про речь так:
«Creating videos with natural and consistent spoken audio, particularly for shorter speech segments, remains an area of active development»
Google DeepMind, страница модели Veo, обращение 20.08.2026
В переводе: ровная и связная речь, особенно на коротких репликах, пока остаётся зоной активной доработки. Речь ломается по той же причине, что лицо и пальцы: в неподвижном снимке её не было, и модель достраивает недостающее наугад. Признание производителя стоит дороже любого стороннего теста, и относиться к нему стоит как к предупреждению, а не как к мелкому шрифту
Вывод из этой механики простой: сначала делайте самый скучный ролик, какой можете придумать, и только потом добавляйте движение. Скучный вариант почти всегда выглядит достоверно, а достоверность в этом жанре и есть качество
Словарь команд движения камеры
Движение камеры задаётся отдельными командами, и у Luma для этого есть готовый набор слов. Пишете в поле ввода слово Camera и нужное движение, и модель применяет его вместо того, чтобы гадать по описанию. Официальное руководство Luma даёт полный список из пяти пар команд
| Команда | Что делает камера | Когда пригодится |
|---|---|---|
Camera Pan Left / Pan Right | Едет горизонтально вдоль сцены | Широкий кадр, панорама города |
Camera Orbit Left / Orbit Right | Оборачивается вокруг точки, даёт объём | Предмет, человек по центру |
Camera Crane Up / Crane Down | Поднимается или опускается | Здания, деревья, высокие кадры |
Camera Move Left / Right / Up / Down | Сдвигается по кадру | Мелкая правка композиции |
Camera Push In / Pull Out | Наезжает или отъезжает | Портрет: наезд усиливает эмоцию |
Таблица прокручивается вбок →
Русские аналоги этих слов сервисы тоже понимают, но английские команды работают предсказуемее просто потому, что руководство написано на них. Шедеврум решил ту же задачу иначе: восемь готовых эффектов кнопками, и придумывать формулировку не нужно вовсе
Ещё одна деталь из того же руководства Luma, которая пригодится тем, кто хочет надпись В кадре: текст нужно заказывать прямо, отдельной конструкцией вида «плакат с надписью, на котором написано вот это». Само по себе оживление надпись на одежде не сохранит, а вот заказанный текст модель попробует нарисовать
Оживить фото со звуком
Со звуком из фотографии сейчас работает Gemini, и это самый заметный сдвиг жанра за последний год. Загружаете снимок, описываете сцену и отдельно то, что должно звучать, и получаете восьмисекундный клип с озвучкой
Куда нажать: пункт Video в панели инструментов под полем ввода, дальше кнопка добавления фотографии
Что увидишь: рамку с подписью про добавление снимка и поле, куда идёт описание сцены и звука одной фразой
Что это даёт: ролик выходит не немой. Шум улицы, шаги, шелест, реплика героя - всё это заказывается словами в том же описании
Функция раскатывалась с 10 июля 2025 года на подписчиков Google AI Pro и Ultra, и в том же анонсе Google приводит цифру принятия: 40 миллионов роликов на модели Veo 3 за семь недель. Сама модель отдаёт картинку в 1080p и 4K, а звук генерирует прямо в момент создания видео, а не подкладывает отдельной дорожкой
У Kling для реплик есть своё правило: то, что персонаж говорит или поёт, берут в кавычки прямо внутри описания. В подсказке под полем ввода это показано примером: ведущий говорит, и его фраза стоит в кавычках. Тот же приём работает с многоязычными репликами, включая разные акценты
И трезвая рамка. Речь из фотографии - самое хрупкое место жанра, о чём производитель предупреждает сам, цитата стоит в разделе «Что ломается на лицах, руках и надписях» выше. Шум, музыка и окружение выходят достоверно, а вот длинную реплику лучше не заказывать
Чтобы не споткнуться: три затыка новичка
Три места, где чаще всего останавливаются, и что с ними делать
- Ролик вышел не про то, что вы хотели. Почти всегда причина в том, что описание было длинным. Уберите всё, кроме одного действия, и запустите снова. Это нормальный рабочий цикл, а не ошибка: в оживлении вторая попытка после короткой правки дешевле и точнее, чем одна долгая попытка сразу
- Кредиты кончились быстрее, чем вы ожидали. Проверьте строку формата под полем ввода: там могло стоять высокое разрешение и четыре варианта за попытку. На пробах ставьте минимум по всем трём переключателям, это разобрано в разделе «Шаг 4. Выбери длину, качество и запусти»
- Лицо на ролике не похоже на человека со снимка. Дело в исходном кадре, а не в сервисе. Обрежьте фотографию так, чтобы лицо занимало заметную часть кадра, и повторите. Если лицо изначально мелкое и мутное, ни один из семи сервисов его не восстановит: оживление не улучшает качество исходника, а наследует его
Что меняется, когда снимок начинает двигаться
Оживление меняет не альбом, а поведение. Пока фотография лежит неподвижной, она конкурирует с сотней таких же в ленте. Как только она двигается, её досматривают, и это заметно по любой площадке, где видео и картинки лежат рядом
Есть и вторая, менее очевидная перемена. Архив семейных снимков перестаёт быть архивом: старый кадр, где никто уже не помнит, что было за секунду до и после, получает эту секунду обратно. Придуманную, но узнаваемую
Практический потолок при этом честный. Один ролик из одного снимка - это ремесло на двадцать минут, ему научился любой, кто дочитал до этого места. Дальше начинается вопрос объёма: снимков не один, роликов нужен поток, и каждая штука снова просит выбрать кадр, придумать фразу и проверить руки
Источники
- Kling AI, страница тарифов - kling.ai: кредиты по тарифам, цена сотни кредитов, снятие фирменной метки и коммерческое использование. Кадр и числа сняты 20.08.2026
- Runway, страница тарифов - runway.com/pricing: 125 разовых кредитов на бесплатном тарифе, месячные пачки платных, перенос неистраченных кредитов. Обращение 20.08.2026
- Luma, страница тарифов - lumalabs.ai/pricing: пачки кредитов и коммерческое использование. Обращение 20.08.2026
- Luma, руководство по движению камеры - lumalabs.ai/learning-hub: полный список команд Pan, Orbit, Crane, Move, Push In и Pull Out. Обращение 20.08.2026
- Luma, руководство по описаниям - lumalabs.ai/learning-hub: требование к формулировке и приём с заказом надписи в кадре. Обращение 20.08.2026
- Google, анонс превращения фотографий в видео в Gemini - blog.google: восемь секунд со звуком, порядок действий, водяные знаки, 40 миллионов роликов за семь недель. Публикация 10.07.2025, обращение 20.08.2026
- Google DeepMind, страница модели Veo - deepmind.google: 1080p и 4K, родная генерация звука, признание про несогласованную речь. Обращение 20.08.2026
- Яндекс, справка Шедеврума «Как создать» - yandex.ru/support/shedevrum: 4 секунды и 24 кадра в секунду, четыре модели, восемь эффектов движения, цена подписки. Кадр снят 20.08.2026
- Яндекс, справка Шедеврума «Примеры» - yandex.ru/support/shedevrum: оживление ранее опубликованных изображений эффектом движения. Обращение 20.08.2026
- Сбер, пост про Kandinsky Video - habr.com: оживление загруженных изображений, 10 роликов бесплатно и по 10 в день после входа. Обращение 20.08.2026
- Новость про оживление фото в приложении Алиса - habr.com: 4 секунды и разрешение 480p. Публикация 16.09.2025, обращение 20.08.2026
- Яндекс, страница функции оживления фото в Алисе AI - alice.yandex.ru/videogen: загрузка своего фото и описание сюжета, готовые промты примерами, условия «быстро, без VPN, бесплатно», кнопка «Скачать приложение». Обращение 21.08.2026
- Центробанк России, официальные курсы валют - cbr.ru: 85,1293 рубля за доллар на 20.08.2026
Памятка: снимок в ролик за двадцать минут
Семь строк, по которым видно, что вы всё сделали правильно
Сохрани себе
- Кадр отобран по правилу «один герой, лицо целиком, руки не переплетены»
- Снимок встал именно в первый кадр, а не в поле образца стиля
- В описании ровно одно действие плюс поведение камеры, не больше
- В строке формата стоят минимальные значения: короткий ролик и низкое разрешение
- Первый ролик заказан самый скучный, движение добавляется следующей попыткой
- Лицо, пальцы и надписи проверены на полном увеличении
- Поехавшее место найдено, кадр или описание пересобраны проще, и ролик запущен заново
Порог входа
Три дня, бесплатно, начать можно сегодня
Ставить ничего не надо и платить тоже: заходите с тем, что уже есть под рукой, и на третий день у вас на руках собранная штука, а не конспект
Люди заходят с нуля, без единого ролика за плечами, и к концу показывают в чате то, что собрали сами
Заявка в закрытый канал, одобряю сразу. Бот сам напишет первым и покажет, как забрать три дня Лагеря. Бесплатно
Частые вопросы
Как оживить фото нейросетью бесплатно?
Три бесплатных входа: Шедеврум с восемью эффектами движения, приложение Алиса с роликом на 4 секунды в разрешении 480p и Kandinsky Video от Сбера с лимитом 10 роликов на старте и по 10 в день после входа в аккаунт. У Runway бесплатный тариф даёт 125 разовых кредитов один раз на знакомство
Сколько секунд длится ролик из фотографии?
От 4 до 8 секунд. Шедеврум и Алиса делают 4 секунды, в окне Kling по умолчанию стоит 5, Gemini на модели Veo 3 отдаёт 8 секунд со звуком. Более длинный ролик собирают из нескольких кусков или продлевают отдельной кнопкой, за одну попытку выходит одна короткая сцена
Почему на ролике поехало лицо и появились лишние пальцы?
Модель дорисовывает то, чего на снимке не было видно: затылок повернувшегося человека, порядок перекрытых пальцев, черты мелкого лица на втором плане. Помогает кадрирование, чтобы в кадре остался один герой крупно: чем меньше модели приходится домысливать, тем меньше шанс поломки
Можно ли оживить старое фото из семейного архива?
Да, порядок тот же, но качество ролика наследует качество исходника: оживление не восстанавливает утраченные детали. Мутный и мелкий кадр даст мутный ролик. Сначала имеет смысл довести снимок до ума инструментами обработки, а оживлять уже финальную версию
Оживить фото со звуком - какой сервис это умеет?
Gemini на модели Veo 3: снимок превращается в восьмисекундный клип, звук описывается словами в том же поле, что и сцена. Каждый ролик получает видимый водяной знак и невидимую метку SynthID. Google при этом сам предупреждает, что ровная речь на коротких репликах пока дорабатывается
Сколько кредитов уходит на один ролик?
Смотря у кого и на какой модели. У Luma и Runway это число печатается прямо на странице тарифов: Luma на модели Ray3.2 в 720p списывает 100 кредитов за 5 секунд (около $0,30, ≈26 ₽), Runway на Gen-4.5 - 60 кредитов за 5 секунд (около $1,15 на тарифе Standard, ≈98 ₽). На других моделях той же страницы Luma счёт другой: у Veo 3.1 стоит 140 кредитов за секунду. У Kling цены одной генерации на открытой странице нет, там видна только цена пакета: по цене первого месяца сотня кредитов стоит от 1,06 доллара на младшем тарифе до 0,49 на старшем
Что писать в поле описания, чтобы получилось достоверно?
Три коротких куска: что на снимке, одно спокойное действие глаголом, поведение камеры. Например «пожилая женщина в синем платке медленно улыбается и моргает, камера медленно приближается». Длинный сценарий на абзац делает ролик дёрганым, а не богатым