ElevenLabs

Речь ElevenLabs

ElevenLabs Speech — сценарий синтеза речи для озвучивания, диалогов, закадрового текста и другого разговорного контента. Выберите голос и модель, затем настройте язык, стабильность, сходство, выразительность, скорость и формат вывода с помощью параметров Omnipix. Перед публикацией прослушайте запись целиком и проверьте произношение, темп и отсутствие случайно озвученных инструкций.

Как пользоваться моделью

  1. 1

    Вставьте готовый текст и удалите примечания или инструкции, которые не должны прозвучать.

  2. 2

    Выберите голос и модель синтеза, подходящие для нужного языка и манеры речи.

  3. 3

    При необходимости укажите язык, затем аккуратно настройте стабильность, сходство, выразительность и скорость.

  4. 4

    Выберите формат вывода под следующий этап: монтаж, воспроизведение или телефонию.

  5. 5

    Создайте запись и прослушайте ее от начала до конца; исправьте текст или настройки, если произношение и темп требуют доработки.

Text to SpeechДоступна

Text to Speech

Эта версия напрямую предоставляет сценарий синтеза речи ElevenLabs: укажите текст, идентификатор голоса, модель синтеза и формат вывода. Дополнительные настройки языка и голоса управляют стабильностью, сходством, выразительностью, усилением сходства и скоростью. Значительная часть подачи определяется самим текстом, поэтому пунктуация и формулировки работают как настройки исполнения.

Свойства

  • Требует текст, идентификатор голоса, модель синтеза и формат вывода.
  • Поддерживает опциональный код языка и детальные настройки голоса.
  • Предлагает несколько речевых аудиоформатов через выбор формата.

Как пользоваться моделью

  1. 1

    Введите финальный текст без служебных заметок, которые не должны прозвучать.

  2. 2

    Выберите идентификатор голоса, модель синтеза и формат вывода.

  3. 3

    Укажите язык, если это помогает однозначно интерпретировать текст.

  4. 4

    Настраивайте стабильность, сходство, выразительность, усиление сходства и скорость небольшими шагами.

  5. 5

    Создайте запись и проверьте произношение, темп, обрезанные фрагменты и случайно озвученные инструкции.

Примеры

Параметры

Текст

Обязательно

Текст для синтеза.

ID голоса

Обязательно

Идентификатор голоса ElevenLabs.

ID модели

Обязательно

Идентификатор модели ElevenLabs TTS.

  • Flash v2.5

  • Turbo v2.5

  • Многоязычный v2

  • v3

Формат вывода

Обязательно

Выходной формат ElevenLabs, передается как параметр запроса output_format.

  • mp3_22050_32

  • mp3_24000_48

  • mp3_44100_32

  • mp3_44100_64

  • mp3_44100_96

  • mp3_44100_128

  • mp3_44100_192

  • pcm_8000

  • pcm_16000

  • pcm_22050

  • pcm_24000

  • pcm_32000

  • pcm_44100

  • pcm_48000

  • ulaw_8000

  • alaw_8000

  • wav_8000

  • wav_16000

  • wav_22050

  • wav_24000

  • wav_32000

  • wav_44100

  • wav_48000

  • opus_48000_32

  • opus_48000_64

  • opus_48000_96

  • opus_48000_128

  • opus_48000_192

Код языка

Необязательно

Необязательный код языка ISO для мультиязычных моделей.

Настройки голоса ElevenLabs

Необязательно