Avatar v2
Эта версия требует один портрет и одну запись речи. Она синхронизирует движения лица с аудио, принимает необязательные указания по мимике и движению и предлагает режимы качества Standard и Professional. Длительность готового видео определяется аудиофайлом.
Свойства
- Обязательные входы: одно портретное изображение и один аудиофайл с речью.
- Длительность результата совпадает с аудио; доступны режимы качества Standard и Professional.
Лучше всего подходит
- Говорящие портреты, ведущие, диалоги персонажей и локализованные звуковые дорожки.
Не рекомендуется
- Движения в полный рост, разговоры нескольких людей и сцены с движением камеры.
Советы
- Для наилучшей синхронизации губ используйте чёткий портрет анфас и чистую запись речи.
Как пользоваться моделью
- 1
Загрузите чёткий портрет JPEG или PNG с одним человеком анфас.
- 2
Загрузите чистую запись речи MP3, WAV, M4A или AAC; результат будет иметь ту же длительность.
- 3
При необходимости опишите умеренную мимику или движение, согласующееся с портретом и речью.
- 4
Выберите Standard или Professional, затем проверьте синхронизацию губ и стабильность лица на всём ролике.
Параметры
Портрет
imageПортрет для анимации. JPEG или PNG до 10 МБ, не менее 300 пикселей по каждой стороне, соотношение сторон от 1:2,5 до 2,5:1.
Аудио
audioРечь, управляющая аватаром. MP3, WAV, M4A или AAC до 5 МБ. Длительность результата совпадает с длительностью аудио.
Промпт
promptНеобязательные указания для мимики и движений аватара.
Режим
modeСтандартный режим быстрее и экономичнее, профессиональный ориентирован на максимальное качество.
Стандартный
Профессиональный