Модель не «находит» движение на снимке — она его придумывает. Отсюда все сильные и слабые стороны результата.
Что происходит с кадром на самом деле
Модель принимает одно изображение и генерирует последовательность кадров, в которой лицо и сцена меняются по правдоподобной траектории. Это называется image-to-video: исходный снимок задаёт первый кадр, всё остальное достраивается. Никакой скрытой информации о движении в фотографии нет — она восстанавливается по тому, как обычно двигаются лица и предметы.
Поэтому качество упирается в две вещи: насколько модель поняла, что изображено, и насколько стабильно она удерживает внешность между кадрами. Первое зависит от резкости и ракурса, второе — от самой модели.
Что определяет результат
Резкий портрет даёт модели опору. Мягкий — заставляет домысливать.
Главное отличие сильных моделей: лицо не меняется от кадра к кадру.
Мимика и лёгкий поворот удаются лучше, чем перемещение по сцене.
Как получить стабильный результат
Чем больше пикселей на лицо, тем меньше додумывания.
«Лёгкая улыбка и поворот головы» работает лучше длинного сценария.
Три-пять секунд — зона, где модели устойчивы.
Генерация вероятностная: из нескольких попыток выбирают лучшую.
Три класса инструментов
| Путь | Когда подходит | Чего стоит |
|---|---|---|
| Видеомодели общего назначения | Нужны сцена и движение целиком | Сходство лица держится хуже |
| Сервисы оживления портретов | ✓ Архивные и семейные снимки | Ограниченный набор движений |
| ИИ-агент по описанию | ✓ Нужна связка операций подряд | Оплата по факту, без подписки |
Задача словами — результат файлом
Leantech AI — это не чат, а исполнитель: задачу описывают словами, а на выходе получают файл. Агент сам разбивает работу на шаги, подбирает под каждый шаг подходящую нейросеть, при необходимости пишет и выполняет код, открывает собранный документ и просматривает его перед выдачей.
Три вопроса про ваш магазин — без почты и регистрации
Класс инструмента выбирают не по вкусу, а по объёму ассортимента и по тому, что нужно на выходе.
Три поля — и видно, что получится в плитке выдачи
Название решает две задачи сразу: по нему товар находят и по нему же решают, открывать ли карточку. Обеим мешает одно — попытка впихнуть всё.
Проверка здесь — редакционная, а не проверка правил площадки: лимит длины и список запрещённых символов у каждой витрины свои и меняются, их смотрят в справке кабинета. Формула же не меняется: сначала что это, потом чем отличается, потом параметр, который сужает выбор.
Она не знает. Движение достраивается по общим закономерностям, а не по данным снимка.
Модель теряет внешность между кадрами — чаще всего из-за мягкого или мелкого исходника.
Да, коротким описанием. Но чем сложнее сценарий, тем выше риск артефактов.
Нет, расчёт идёт на серверах сервиса. Локальные модели требуют видеокарты.
Куда идти дальше
Реставрация и движение: правильный порядок.
Ролик из нескольких снимков, а не из одного.
Рисунки и иллюстрации ведут себя иначе, чем фотографии.
Опишите движение словами и приложите снимок — заберите готовый ролик
⚡ Поставить задачу →