Voice Cloning
MiniMax Voice Cloning принимает референсный аудиофайл и имя, а затем возвращает голос для совместимого синтеза речи MiniMax. Можно настроить точность, а также опционально применить шумоподавление и нормализацию громкости. Для объективной оценки протестируйте полученный голос на коротком тексте, который отличается от референсной записи.
Свойства
- Требует имя и референсный аудиофайл.
- Предоставляет настройку точности от 0 до 1.
- Предлагает опциональные шумоподавление и нормализацию громкости исходника.
- Возвращает идентификатор голоса для совместимого синтеза речи MiniMax.
Лучше всего подходит
- Персональное озвучивание
- Стабильные голоса персонажей
Советы
- Используйте чистую запись с одним диктором и минимальным фоновым шумом.
Как пользоваться моделью
- 1
Убедитесь, что вам разрешено использовать запись диктора и синтезированный голос.
- 2
Загрузите чистую запись одного диктора и задайте понятное имя.
- 3
Настройте точность, затем включите шумоподавление или нормализацию громкости только при необходимости очистки.
- 4
Создайте клон и сохраните полученный идентификатор голоса.
- 5
Протестируйте идентификатор в MiniMax Speech на коротком характерном тексте перед более длительным использованием.
Параметры
Название голоса
nameЛичное название этого голоса в вашей библиотеке. Оно не отправляется в MiniMax.
Запись голоса
voice_fileЗагрузите аудио длительностью от 10 секунд до 5 минут и размером до 20 МБ. Неподдерживаемые форматы будут преобразованы в совместимый WAV.
Допуск записи
accuracyСтрогость проверки записи MiniMax перед клонированием. Оставьте рекомендуемое значение 0,7; снижайте его, только если качественная запись отклоняется.
Шумоподавление
need_noise_reductionВключите, если в записи есть фоновый шум. Для чистой записи оставьте выключенным, чтобы не изменять голос.
Нормализация громкости
need_volume_normalizationВключите, если запись слишком тихая или ее громкость заметно меняется. Оставьте выключенным, если громкость уже ровная.