Руководство

Как переписать говорящее видео с новым сценарием

FreeLipSync TeamFreeLipSync Team|4 мин чтения
Обложка руководства с исходным видео, клонированным голосом и новым сценарием

Чтобы изменить слова в говорящем видео без новой записи, откройте Text to Video Lip Sync, загрузите исходный ролик, введите новый текст и выберите голос. Сервис создаст речь по тексту и синхронизирует её с отснятой игрой человека. Ниже — задачи, для которых подходит этот путь, и пример результата.

Зачем переписывать речь в видео текстом?

Исправить сообщение без пересъёмки

После съёмки презентации могут измениться цена, дата, название функции или призыв к действию. Ради нескольких слов неудобно снова собирать камеру, свет и площадку. Подготовьте исправленную реплику и используйте уже снятое видео.

Если исправить нужно лишь фрагмент длинного фильма, экспортируйте его отдельно, создайте новую версию и верните в монтаж. Сервис сам не находит и не заменяет одно предложение в готовой временной шкале. Жест в сторону старой цены тоже останется.

Сделать несколько версий из одной реальной съёмки

Автору, преподавателю или представителю компании могут понадобиться разные вступления для курсов, кампаний и регулярных новостей. Короткий фрагмент с естественными универсальными жестами подходит для нескольких сценариев: человек остаётся реально снятым, а повторять съёмку каждый раз не нужно.

Текстовый режим удобен, когда слова утверждены, но итоговая запись речи ещё не готова. Выберите готовый голос или клонируйте голос с разрешения. Если запись уже есть и важны её интонация и темп, изучите инструкцию по загрузке аудио.

Подготовить вариант на другом языке

Можно ввести проверенный перевод и подобрать голос для нужного языка. Сначала проверьте смысл, имена, числа и тон: синхронизация губ сама не переводит оригинальную речь. Подробнее — в руководство по ИИ-дубляжу.

Выбрать исходник для разных сценариев

Исходное видео задаёт движения, мимику и кадр; новую фразу в нём произносить не нужно. Здесь повторно используется ролик длительностью 5,06 секунды, а результат с текстом и голосом длится около 10 секунд. Тот же исходник есть в руководстве с загруженным аудио для сравнения способов.

Используйте материал, который имеете право редактировать. Ролик не обязан быть длинным, а лицо — всё время смотреть прямо в камеру с чётко видимым ртом. Важнее естественные движения и выражения, подходящие к разным сообщениям. Этот видеопроцесс справляется и с некоторыми кадрами, сложными для обычных методов липсинка, например с кратким поворотом головы.

Небольшая смена позы универсальна, а указание на конкретный товар или счёт на пальцах могут противоречить новой реплике. Видеопроцесс сохраняет снятые движения и мимику, меняя синхронизацию речи; он не создаёт заново всю игру человека. Для генерации движений по изображению существует отдельная, более долгая модель Max.

Написать реплику и выбрать голос

Перед генерацией проверьте имена, цифры, даты и произношение. В текстовом режиме можно выбрать готовый голос или загрузить либо записать короткий разрешённый образец для клонирования. Он задаёт тембр, а не служит окончательной записью новой фразы. В примере используется примерно 16-секундный образец на английском языке:

Образец голоса

Например: «Теперь занятие начинается в пятницу в десять утра». Это пример текста для ввода, не расшифровка старого демонстрационного видео.

Создать и проверить результат

В Text to Video Lip Sync загрузите ролик, выберите голос, вставьте сценарий и запустите генерацию. Сравните услышанные слова с утверждённым текстом и проверьте, подходят ли исходные жесты и мимика к новому сообщению.

Ниже — короткий существующий пример текстового ввода с образцом голоса. Это не длинный результат и не полная запись экрана со всеми действиями.

Открыть страницу просмотра результата

Длительность исходника и результата может различаться. Для длинного текста следите, чтобы повторно использованные жесты не выглядели неуместно. Отдельно проверенный пример разницы длительности — пять секунд исходника и 39 секунд результата.

Частые вопросы

Нужно ли произносить новую фразу в исходном видео?

Нет. Исходник даёт снятые движения и мимику. Введите новые слова отдельно и выберите голос для создаваемой речи.

Обязательно ли клонировать голос?

Нет. В примере есть голосовой образец, но можно выбрать и готовый голос. Клонируйте только свой голос или тот, на использование которого есть разрешение.

Когда загружать аудио вместо текста?

Выбирайте текст, если сценарий готов, но финальной записи ещё нет. Если готовая запись уже есть и нужно сохранить её интонацию и темп, используйте аудиопроцесс.

Можно ли использовать один исходник для разных сценариев?

Да. Естественные, универсальные жесты позволяют делать несколько версий. Каждый результат нужно проверить на соответствие снятых действий новым словам.

Последнее обновление:

Похожие уроки