Fellowi

Как писать запросы для ИИ-видео: описывайте движение, а не картинку

Автор: Команда Fellowi · · 7 мин чтения

Абстрактные индиговые и фиолетовые дуги, проносящиеся по тёмному кадру как траектории камеры, с едва заметным контуром кинокадра в центре.

Вот одна мысль, которая исправляет большинство плохих видеозапросов: при генерации видео из изображения картинка уже сделала половину работы. Всё, что вы загружаете в Fellowi Video, определяет, кто в кадре, во что одет, где стоит, как падает свет. Модель всё это видит. Поэтому когда запрос тратит тридцать слов на повтор этого, вы описали стартовую точку дважды, а следующие четыре секунды - ни разу. Картинка отвечает за что. Запрос отвечает за как оно двигается.

Если вы читали наше руководство по запросам для изображений, обратите внимание, насколько это другая задача. Запрос для изображения строит сцену с нуля, поэтому детали там помогают. Видеозапрос получает готовую сцену и добавляет время. Детали о сцене теперь шум, детали о движении - сигнал.

Пять вопросов, на которые должен отвечать видеозапрос

Все пять в каждом запросе не нужны. Но хороший запрос отвечает хотя бы на два-три, а слабый обычно ни на один.

1. Камера: движется ли она и как?

Статичная, медленный наезд, медленный отъезд, плавная панорама влево или вправо, лёгкое дрожание «с рук». Назовите одно. Медленно движущаяся камера - самый простой способ превратить стоп-кадр в съёмку, даже если больше ничего не меняется.

2. Движение героя: что делает человек или предмет?

Поворот головы, вдох, появляющаяся улыбка, волосы, которые приподнимает ветер, пальцы, смыкающиеся на чашке. Маленькое и конкретное бьёт большое и расплывчатое. «Она поднимает взгляд и улыбается» сработает; «она двигается естественно» оставляет модель гадать.

3. Темп: насколько быстро всё происходит?

Замедленная съёмка, реальное время, ленивое скольжение, быстрый взгляд. Темп решает, будут ли четыре секунды ощущаться как мгновение или как нарезка. Если сомневаетесь, пишите «медленно». Медленное читается как замысел, быстрое - как хаос.

4. Настроение и среда: что меняется в мире вокруг?

Мерцание света, шевелящиеся шторы, начинающийся дождь, пар над кофе, пыль в солнечном луче. Одна деталь среды даёт сцене пульс и не позволяет фону выглядеть приклеенным.

5. Звук: что мы должны услышать?

Fellowi Video генерирует звук к каждому клипу, и именно в запросе вы им управляете. Тихий дождь, далёкий шум машин, тихая комната с часами, ветер в листве, приглушённая фоновая музыка. Если не сказать ничего, модель выберет сама. Если назвать одно, она обычно слушается.

До и после

В каждой паре один и тот же стартовый кадр. Меняется только запрос.

Портрет у окна

До: «Красивая женщина с длинными тёмными волосами в белой рубашке стоит у окна в светлой квартире».

Это подпись к картинке. Модель уже знает каждое слово, и ничего здесь не говорит, что происходит.

После: «Медленный наезд. Она поворачивает голову к окну и тихо выдыхает; прядь волос приподнимает лёгкий ветерок. Штора колышется. Тихая комната, за окном едва слышный гул города».

Камера, движение героини, среда и звук на одном дыхании, и ничего не повторено из картинки.

Горное озеро в сумерках

До: «Эпичный кинематографичный закат над озером с горами, драматичный свет, 4K, гиперреализм».

Прилагательные о качестве ничего не дают движению, а «4K» - не то, чем можно попросить стать клип в 720p.

После: «Статичная камера. По воде медленно расходятся круги; облака плывут вправо; последний свет на вершинах чуть гаснет. Ветер над водой, одинокая далёкая птица».

Фото, сгенерированное на вкладке «Фото»

До: «Оживи. Реалистично. Она идёт через комнату, берёт телефон, садится на диван, смеётся и машет в камеру».

Четыре действия за четыре секунды. Модель попробует все и не закончит ни одно.

После: «Лёгкое дрожание камеры с рук. Она бросает взгляд в камеру и медленно расплывается в улыбке. Мягкий домашний свет мерцает. Приглушённая музыка из другой комнаты».

Одно действие с началом и концом, и оно спокойно умещается в клип. Если нужен ещё и путь до дивана, это второй клип с другим стартовым кадром, а не более длинное предложение. В статье о том, как оживить свои ИИ-фото, мы разбираем, как так собирать последовательность.

Три ошибки, которые портят клип

Повторное описание картинки

Самая частая и самая простительная, потому что запросы для изображений приучают делать именно это. Проверьте себя: закройте картинку и прочитайте запрос. Если он мог бы быть подписью к стоп-кадру, видеозапрос вы ещё не написали. Вырежьте каждое слово, которое модель и так видит, и потратьте их на движение.

Слишком много действий на четыре секунды

Поворот головы занимает около секунды. Улыбка - ещё одну. Шаг или два - всё остальное. Это весь клип. Всё, что сверх двух чётких движений, сжимается в смазанное пятно или молча выбрасывается. Выберите один жест, о котором этот момент, и пусть камера и среда несут остальное.

Противоречие картинке

Если человек сидит, не просите его бежать. Если ночь, не просите яркого солнца. Если он стоит спиной, не просите крупный план глаз. Модель обязана уважать стартовый кадр, поэтому запрос, который с ним спорит, даёт искажения, «плавление» или лицо, которое перестаёт быть похожим на загруженное. Работайте с тем, что есть в картинке: движение, о котором вы просите, должно правдоподобно вытекать именно из этого кадра.

Небольшой шаблон для старта

Заполните то, что подходит, остальное удалите:

  • Камера: статичная / медленный наезд / медленный отъезд / плавная панорама / дрожание с рук
  • Герой: один жест с началом и концом
  • Темп: медленно / реальное время
  • Среда: одна вещь, которая движется на фоне
  • Звук: одна-две фоновые подсказки

В сборе: «Медленный отъезд. Он опускает книгу и смотрит на дождь за окном. Свет лампы мерцает. Дождь по стеклу, шелест страниц». Это около двадцати слов, и это законченный видеозапрос.

Частые вопросы

Какой длины должен быть видеозапрос?

Одно-три коротких предложения. Если вы перевалили за сорок слов, вы, скорее всего, описываете картинку или нагромождаете действия. Режьте, пока не останутся только движение, темп и звук.

Нужно ли упоминать, как выглядит человек?

Только если это часть движения («её волосы приподнимаются», «его шарф развевается»). Внешность зафиксирована картинкой; повторять её бессмысленно, и это вытесняет полезные слова.

Что если рендер не удался?

Неудавшийся рендер никогда не оплачивается: монеты возвращаются, а слот плана Director восстанавливается. Обычное лекарство - упростить: меньше действий, медленнее темп и никаких указаний, спорящих со стартовым кадром. Попробуйте снова с той же картинкой.

Можно ли просить откровенный контент?

Fellowi - платформа 18+, и контент для взрослых между взрослыми разрешён. Всё, что связано с несовершеннолетними или отсутствием согласия, отклоняется безоговорочно. Правила выше работают точно так же: описывайте движение, держитесь одного-двух тактов и не спорьте с кадром.

Где это попробовать?

Откройте студию через значок волшебной палочки в шапке сайта или перейдите сразу на fellowi.com/video. Выберите стартовый кадр, вставьте запрос и посмотрите, на что способны двадцать точных слов.

Попробуйте сами

Тёплый приватный ии-компаньон: 7 дней бесплатно и 30 сообщений, без карты.

Цены и лимиты

Читать дальше