Коты поют в машине под Baby: как сделать видео с ИИ — StudyAI
Назад

Два кота сидят на передних сиденьях автомобиля, поют, качают головами и отбивают ритм лапами. Сделать такое автокараоке можно с вашими питомцами: загрузить их фотографии и задать нейросети сцену, движения и распределение ролей.

Для узнаваемой версии под Baby Джастина Бибера основой служит Justin Bieber Carpool Karaoke с Джеймсом Корденом. Ниже — как заменить участников этой сцены на животных, что написать в промпте и как создать собственное караоке в машине без исходного видео.

Что это за оригинал

Сцена относится к выпуску The Late Late Show with James Corden от 20 мая 2015 года. Бибер сидит на пассажирском месте слева в кадре, Корден — за рулем справа. Они едут по Лос-Анджелесу и поют Baby. Это фрагмент телевизионного Carpool Karaoke; официальным клипом песни он не является.

Оба участника пристегнуты. Камера спереди показывает темный салон, передние сиденья и центральный подлокотник. Во время исполнения участники открывают рот в ритме вокала, поворачиваются друг к другу и жестикулируют. При замене людей на животных именно посадка, характер жестов и окружение сохраняют узнаваемость сцены.

Название выпуска и официальная ссылка зафиксированы в архиве CBS / Paramount; исполнение Baby описано в публикации TheWrap от 21 мая 2015 года. Официальный ролик на YouTube сейчас закрыт, поэтому для работы с видеореференсом понадобится уже доступный вам исходный фрагмент. Если его нет, используйте сценарий по фотографиям ниже.

Самый простой способ: фрагмент клипа и фото персонажей

Проще всего вырезать из клипа понравившийся кусок до 14 секунд, загрузить его в Seedance вместе с фото персонажей и вставить готовый промпт.

  1. Вырежьте понравившийся момент клипа длиной до 14 секунд любым видеоредактором — Seedance 2.5 принимает входящее видео до 14 секунд.
  2. Откройте Seedance 2.5 в StudyAI и загрузите фрагмент как видеореференс.
  3. Добавьте фото или картинки персонажей — по одному на каждого героя этой статьи, в том порядке, который указан в промпте.
  4. Вставьте промпт ниже и запустите генерацию.
  5. Проверьте результат; если звук в ролике не сохранился, наложите тот же фрагмент песни в редакторе — по длине он уже совпадает.

Так не нужно отдельно собирать стартовый кадр, монтировать планы и подгонять движения: движения, ракурсы и темп берутся из фрагмента.

Открыть в Seedance 2.5 с этим промптом

Способы ниже пригодятся, если исходного клипа нет или нужен полный контроль над сценой.

Как устроена замена участников на котов

Нейросеть получает два вида материалов. Видео задает действия: кто где сидит, когда поет, как двигается и какие планы сменяют друг друга. Фотографии задают внешность: окрас, морду, уши и другие особенности каждого животного.

Вместо Бибера появляется питомец с первой фотографии, вместо Кордена — со второй. Менять нужно участников целиком: человеческие головы, тела и кисти превращаются в морды, тела и лапы животных. Салон, ремни, руль, дневное освещение и последовательность движений остаются ориентиром из исходного видео.

Что подготовить перед генерацией

  • Две фотографии. На каждой хорошо видны морда, глаза, уши, грудь и по возможности передние лапы. Первое фото — пассажир слева в кадре, второе — водитель справа.
  • Короткий фрагмент видео для переноса сцены. Начните с 8–10 секунд, где видны оба участника и есть понятные движения. Не загружайте целый выпуск.
  • Готовый промпт с распределением ролей и требованиями к результату.

Снимки должны быть четкими, без фильтров и предметов перед мордой. Не подходят фотографии спящего питомца, кадры со спины и снимки с сильным размытием. Фотографировать кота в машине не нужно: окружение берется из видео или текстового описания.

Два разных окраса помогут различать персонажей. Можно использовать кота и собаку, двух собак или других питомцев — важно сохранить отдельную фотографию и отдельную роль для каждого.

В какой нейросети сделать автокараоке

Основной вариант — Seedance 2.5 в StudyAI. На странице модель сейчас называется Seedance 2.5 Lite; сервис указывает работу с референсами и ролики до 30 секунд. Для замены людей выбирайте доступный режим с видео и изображениями: один текстовый запрос не обеспечит повторение исходных движений.

Альтернатива — MiniMax H3, для которой StudyAI указывает входные изображения, видео и аудио. Длительность и настройки у нее отличаются. Другие варианты есть в каталоге видео- и аудиомоделей. Перед запуском ориентируйтесь на возможности выбранного режима и стоимость, показанную в интерфейсе.

Как сделать поющих котов по исходному видео

Шаг 1. Откройте модель с промптом

Открыть Seedance с промптом для питомцев

Ссылка заполнит поле запроса. Видео и фотографии через нее не передаются: прикрепите их самостоятельно, выберите настройки и затем запустите генерацию.

Шаг 2. Загрузите исходный фрагмент и фотографии

Выберите режим с видеореференсом и изображениями, если он доступен в вашем интерфейсе. Добавьте подготовленный фрагмент, затем фото пассажира и фото водителя. Проверьте порядок: слова «первое фото» и «второе фото» в промпте должны соответствовать файлам.

Если референсам можно дать названия, подпишите их «исходное видео», «пассажир» и «водитель». Не добавляйте случайные снимки нескольких животных вперемешку: модель должна понимать, какая внешность относится к каждому месту.

Шаг 3. Настройте длительность и кадр

Для первого теста сохраните горизонтальный формат, близкий к исходному. Так в кадре останутся оба питомца, их лапы, руль и подлокотник. Вертикальную обрезку лучше делать после проверки сцены.

Выберите длительность, соответствующую подготовленному отрывку и ограничениям режима. Сначала проверьте короткий эпизод, а затем переходите к более длинной сцене. Максимальные 30 секунд не обязательны: длинный ролик дороже пересоздавать, если окрас или лапы начинают меняться.

Шаг 4. Задайте замену обоих участников

Вставьте текст ниже, если он еще не подставлен. Здесь внешность берется из двух фотографий, а движения — из видео. Стороны указаны с точки зрения зрителя.

Шаг 5. Проверьте музыку и пение

Для версии под Baby нужен тот же темп и тот же фрагмент исполнения, что в сцене. Если выбранный режим позволяет сохранять исходное аудио, включите эту настройку. Просьба в промпте сама по себе не гарантирует, что дорожка перенесется без изменений.

Когда генератор меняет или убирает звук, совместите удачное видео с доступной вам музыкальной дорожкой в видеоредакторе, например CapCut. Выровняйте начало вокальной фразы и движение рта. Простое наложение песни не исправит случайную анимацию морды: если рот не следует вокалу, доработайте запрос и повторите короткую генерацию.

Шаг 6. Просмотрите весь ролик

Остановите видео на общем плане и на крупных планах. Проверьте, что:

  • в кадре ровно два питомца, и они не меняются местами;
  • морды, уши, глаза и окрас совпадают с фотографиями;
  • люди заменены целиком, включая кисти и предплечья;
  • лапы не сливаются с рулем, ремни не проходят сквозь тело;
  • салон и освещение сохраняются при смене ракурса;
  • пение и короткие жесты попадают в ритм.

Если сбой появляется на сложном жесте, возьмите более спокойный отрывок. Если меняется внешность, уточните конкретный признак: «белое пятно на груди пассажира остается во всех планах». При следующей попытке исправляйте одну проблему — так проще понять, какое уточнение сработало.

Как создать котов в машине без исходного ролика

Загрузите две фотографии и создайте собственную музыкальную сцену: общий план двух питомцев, по короткой сольной фразе каждого и совместный финал. Эта версия сохраняет идею автокараоке, но не повторяет точный монтаж и исполнение оригинала.

Промпт рассчитан на 10 секунд и новую мелодию с вокалом без слов. Если такой длительности нет в настройках, согласуйте расписание сцен с ближайшим доступным значением. Звуковая часть сработает в режиме, который поддерживает ее генерацию.

Чтобы сменить автомобиль, окружение или стиль, доработайте описание в генераторе промптов StudyAI. Сначала закрепите внешний вид и места двух питомцев, затем добавляйте новые детали.

Что исправить, если результат не получился

Коты мяукают вместо пения. Укажите вокальное исполнение и синхронизацию рта с голосом. Запретите мяуканье и отдельные реплики. Для версии по видео проверьте, используется ли его звуковая дорожка.

Остались человеческие руки. Добавьте требование полной замены тела и естественных лап. Для первого теста избегайте быстрых движений кистей перед лицом.

Животные поменялись местами. Проверьте порядок фотографий, повторите распределение «фото 1 — слева, фото 2 — справа» и уточните, что речь о сторонах кадра для зрителя.

Меняются морды и шерсть. Используйте более четкие фотографии, сократите отрывок и закрепите отличительные признаки. Не усложняйте сцену дополнительными персонажами.

После обрезки виден только один кот. Сохраните горизонтальный результат или разместите его на вертикальном фоне. Для такого дуэта важнее видеть обоих участников, чем заполнить изображением всю высоту экрана.

Сохраните удачную версию

Скачайте готовое видео в доступном качестве. Хороший короткий ролик сразу показывает двух питомцев, дает каждому выразительный момент и заканчивается общей реакцией. Увеличивайте длительность после того, как модель удерживает обе внешности и правильно переносит движения.

Какой тариф выбрать. Для видео рекомендуем начинать с тарифа START+ за 549 ₽ на 30 дней: генерация видео затратная и не всегда получается с первой попытки. Тарифа LITE за 199 ₽ на 7 дней обычно хватает максимум на одно видео.

Сделать автокараоке со своими питомцами

ВКонтакте Telegram