HeyGen

Видео HeyGen

Video Agent создаёт готовый ролик по одному брифу, а Avatar Video рендерит готовый образ HeyGen. Video Translation локализует видео на другой язык. Lipsync сохраняет исходное исполнение и синхронизирует отдельную аудиодорожку в режиме Speed или Precision.

Как пользоваться моделью

  1. 1

    Выберите Video Agent для готового ролика, Avatar Video для выбранного ведущего, Translation для локализации или Lipsync для замены речи отдельным аудио.

  2. 2

    Для ролика с аватаром выберите аватар и укажите либо сценарий с голосом, либо готовую аудиодорожку — не оба варианта одновременно.

  3. 3

    Настройте соотношение сторон, разрешение 720p или 1080p и формат результата под место публикации.

  4. 4

    Перед публикацией проверьте произношение, синхронизацию губ, кадрирование и соответствие голоса говорящему.

3Доступна

HeyGen Avatar Video

Avatar Video требует готовый образ с поддержкой выбранного движка Avatar IV или Avatar III и ровно один источник речи. Выберите либо сценарий с голосом, либо готовую аудиодорожку. Для фотоаватаров с Avatar IV доступны промпт движения и выразительность. В Omnipix доступны 720p и 1080p, по умолчанию используется 1080p.

Свойства

  • Требует готовый образ аватара, совместимый с выбранным движком Avatar IV или Avatar III.
  • Сценарий и аудио взаимоисключающие; идентификатор голоса применяется к сценарию.
  • Промпт движения и выразительность доступны только для фотоаватаров с Avatar IV.

Как пользоваться моделью

  1. 1

    Выберите движок, затем укажите один из совместимых с ним готовых образов аватара.

  2. 2

    Если используется сценарий, выберите голос и проверьте произношение и паузы.

  3. 3

    Для фотоаватара с Avatar IV при необходимости опишите движение и выберите выразительность.

  4. 4

    Настройте соотношение сторон, разрешение 720p или 1080p и формат результата.

  5. 5

    После рендера проверьте синхронизацию губ и кадрирование перед публикацией.

Примеры

Параметры

Аватар

Обязательно

Выберите один из сохраненных аватаров.

Движок аватара

Необязательно

Avatar IV рекомендуется для управления движением; Avatar III использует отдельный конвейер фото-в-видео. Выбранный образ должен поддерживать движок.

  • Avatar IV

  • Avatar III

Сценарий

Необязательно

Что должен говорить аватар. Используйте Script или Audio.

Аудио

Необязательно

Аудио для липсинка аватара. Используйте либо Audio, либо Script.

Голос

Необязательно

Выбранный любимый голос для использования при генерации из сценария.

Название

Необязательно

Необязательное имя для этого сгенерированного видео.

Разрешение

Необязательно

Разрешение итогового видео.

  • 720p

  • 1080p

Соотношение сторон

Необязательно

Форма итогового кадра видео.

  • 16:9

  • 9:16

  • 4:5

  • 5:4

  • 1:1

  • Авто

Удаление фона

Необязательно

Удаляет фон, если выбранный аватар это поддерживает.

Формат вывода

Необязательно

Формат загрузки итогового видео.

  • mp4

  • webm

Промпт движения

Необязательно

Описание движения тела и жестов на естественном языке. Доступно только для фотоаватаров с Avatar IV.

Выразительность

Необязательно

Энергичность и диапазон движений. Доступно только для фотоаватаров с Avatar IV.

  • Низкая

  • Средняя

  • Высокая

3Доступна

HeyGen Lipsync

HeyGen Lipsync принимает один видеофайл и одну аудиодорожку. Режим Speed дешевле и рассчитан на более быструю обработку, а Precision использует более качественный путь синхронизации губ. Дополнительные параметры позволяют сохранить исходный формат, создать субтитры, улучшить речь, удалить музыкальную дорожку, ограничить временной диапазон и выбрать обработку частоты кадров. Omnipix сохраняет готовое видео и возвращённый файл субтитров, а итоговую стоимость рассчитывает по фактической длительности результата HeyGen.

Свойства

  • Требует один сохранённый видеофайл и один сохранённый аудиофайл.
  • Speed оплачивается по $0,0333 за секунду результата, Precision — по $0,0667.
  • Итоговая стоимость рассчитывается по фактической длительности, возвращённой HeyGen.

Как пользоваться моделью

  1. 1

    Загрузите видео с одним хорошо видимым говорящим лицом и чистую заменяющую аудиодорожку.

  2. 2

    Выберите Speed для более дешёвой обработки или Precision, когда важнее качество синхронизации губ.

  3. 3

    Настройте субтитры, сохранение формата, удаление музыки, улучшение речи, временной диапазон и режим кадров только при необходимости.

  4. 4

    Проверьте весь результат: движения губ, непрерывность аудио, плавность кадров и возвращённые субтитры.

Параметры

Видео

Обязательно

Аудио

Обязательно

Название

Необязательно

Режим

Необязательно
  • Speed

  • Precision

Создать субтитры

Необязательно

Сохранить исходный формат

Необязательно

Динамическая длительность

Необязательно

Отключить музыкальную дорожку

Необязательно

Улучшить речь

Необязательно

Время начала

Необязательно

Время окончания

Необязательно

Режим частоты кадров

Необязательно
  • Переменная

  • Постоянная

  • Без изменения

3Доступна

HeyGen Video Agent

Video Agent превращает творческий бриф в готовое видео. HeyGen самостоятельно формирует сценарий, выбирает аватар, строит сцены и выполняет рендеринг. Omnipix использует одношаговый режим generate: каждый запрос создаёт один ролик без интерактивной сессии правок.

Свойства

  • Только одношаговый режим generate; чат и сообщения с правками недоступны.
  • Оплата рассчитывается по фактической длительности готового видео.

Как пользоваться моделью

  1. 1

    В одном промпте укажите цель, аудиторию, ключевое сообщение, желаемый тон и примерную структуру.

  2. 2

    Добавьте формулировки, факты и призывы к действию, которые обязательно должны прозвучать.

  3. 3

    Выбирайте альбомную или портретную ориентацию только когда этого требует площадка; иначе позвольте HeyGen определить формат.

  4. 4

    Проверьте сценарий, ведущего, темп сцен, точность фактов и финальный призыв к действию.

Параметры

Промпт

Обязательно

Опишите цель видео, аудиторию, сообщение, тон, визуальное направление и обязательный текст озвучки.

Ориентация

Необязательно

Необязательная ориентация результата. Оставьте поле пустым, чтобы HeyGen определил её по промпту.

  • Альбомная

  • Портретная

3Архивная

HeyGen Image to Video

Image to Video отправляет исходный портрет напрямую в HeyGen v3 Video API. Допускается ровно один источник речи: сценарий с выбранным голосом или загруженная аудиодорожка. Модель остаётся недоступной до проверки поведения провайдера и списаний в staging.

Свойства

  • Вход: одно изображение и ровно один источник речи.
  • Использует тип image в v3 без параметров движения, предназначенных только для аватаров.

Как пользоваться моделью

  1. 1

    Загрузите чёткий портрет с одним видимым человеком.

  2. 2

    Укажите либо сценарий и голос, либо готовую аудиодорожку.

  3. 3

    Выберите целевое соотношение сторон и разрешение.

  4. 4

    Перед публикацией проверьте мимику, синхронизацию губ и кадрирование.

Параметры

Портрет

Обязательно

Четкое портретное изображение анфас.

Сценарий

Необязательно

Текст, который произносит человек на изображении. Используйте сценарий или аудио.

Аудио

Необязательно

Аудио для синхронизации губ. Используйте аудио или сценарий.

Голос

Необязательно

Голос для озвучивания сценария.

Название

Необязательно

Отображаемое название в HeyGen.

Разрешение

Необязательно

Разрешение итогового видео.

  • 720p

  • 1080p

  • 4K

Соотношение сторон

Необязательно

Авто сохраняет форму исходного изображения, когда это возможно.

  • 16:9

  • 9:16

  • 4:5

  • 5:4

  • 1:1

  • Авто

Удалить фон

Необязательно

Удалить фон изображения из созданного видео.

3Архивная

HeyGen Video Translation

Video Translation сохраняет исходное выступление и создаёт отдельный локализованный результат для каждого целевого языка. Используйте чистый исходник с разборчивой речью, осознанно выбирайте режим перевода и проверяйте каждый язык отдельно.

Свойства

  • Вход: одно исходное видео; выход: отдельная задача перевода для каждого языка.
  • Поддерживает клонирование голоса и локализацию с синхронизацией губ.

Как пользоваться моделью

  1. 1

    Загрузите видео с чистой речью и минимальным наложением голосов.

  2. 2

    Выберите все целевые языки и доступный режим speed или precision.

  3. 3

    До запуска настройте доступный временной диапазон или режим только аудио.

  4. 4

    Для каждого результата проверьте терминологию, голос, тайминг и синхронизацию губ.

Примеры

Параметры

Видео

Обязательно

Видео для перевода

Языки вывода

Обязательно

Список языков вывода для перевода

  • Африкаанс

  • Албанский

  • Амхарский

  • Арабский

  • Армянский

  • Азербайджанский

  • Баскский

  • Белорусский

  • Бенгальский

  • Боснийский

  • Болгарский

  • Бирманский

  • Каталанский

  • Китайский (упрощенный)

  • Китайский (традиционный)

  • Хорватский

  • Чешский

  • Датский

  • Нидерландский

  • Английский (Великобритания)

  • Английский (США)

  • Эстонский

  • Филиппинский

  • Финский

  • Французский

  • Галисийский

  • Грузинский

  • Немецкий

  • Греческий

  • Гуджарати

  • Гаитянский креольский

  • Иврит

  • Хинди

  • Венгерский

  • Исландский

  • Индонезийский

  • Ирландский

  • Итальянский

  • Японский

  • Яванский

  • Каннада

  • Казахский

  • Кхмерский

  • Конкани

  • Корейский

  • Лаосский

  • Латинский

  • Латышский

  • Литовский

  • Малайский

  • Малаялам

  • Мальтийский

  • Маратхи

  • Монгольский

  • Непальский

  • Норвежский

  • Ория

  • Пушту

  • Персидский

  • Польский

  • Португальский

  • Пенджаби

  • Румынский

  • Русский

  • Сербский

  • Сингальский

  • Словацкий

  • Словенский

  • Сомалийский

  • Испанский

  • Сунданский

  • Суахили

  • Шведский

  • Тамильский

  • Телугу

  • Тайский

  • Турецкий

  • Украинский

  • Урду

  • Узбекский

  • Вьетнамский

  • Валлийский

  • Зулу

Аудио

Необязательно

Аудио для перевода.

Только перевод аудио

Необязательно

Перевести только аудио, сохранить оригинальное видео

Количество спикеров

Необязательно

Количество дикторов (улучшает разделение дикторов)

Режим

Необязательно

Режим качества перевода: 'speed' (быстрее) или 'precision' (выше качество, использует инференс аватара)

  • Быстрый

  • Качество

Включить субтитры

Необязательно

Создавать субтитры для переведенного видео.

Сохранить формат

Необязательно

Сохранить спецификации кодирования исходного видео (разрешение, битрейт).

Включить динамическую длительность

Необязательно

Разрешает динамическую регулировку длительности.

Отключить музыкальную дорожку

Необязательно

Удалить фоновую музыку

Включить улучшение речи

Необязательно

Улучшите качество речи

Время начала

Необязательно

Время начала в секундах для частичного перевода

Время окончания

Необязательно

Время окончания в секундах для частичного перевода

Файл субтитров

Необязательно

Предоставьте файл субтитров для переведенного видео.