Text to Speech
Эта версия напрямую предоставляет сценарий синтеза речи ElevenLabs: укажите текст, идентификатор голоса, модель синтеза и формат вывода. Дополнительные настройки языка и голоса управляют стабильностью, сходством, выразительностью, усилением сходства и скоростью. Значительная часть подачи определяется самим текстом, поэтому пунктуация и формулировки работают как настройки исполнения.
Свойства
- Требует текст, идентификатор голоса, модель синтеза и формат вывода.
- Поддерживает опциональный код языка и детальные настройки голоса.
- Предлагает несколько речевых аудиоформатов через выбор формата.
Как пользоваться моделью
- 1
Введите финальный текст без служебных заметок, которые не должны прозвучать.
- 2
Выберите идентификатор голоса, модель синтеза и формат вывода.
- 3
Укажите язык, если это помогает однозначно интерпретировать текст.
- 4
Настраивайте стабильность, сходство, выразительность, усиление сходства и скорость небольшими шагами.
- 5
Создайте запись и проверьте произношение, темп, обрезанные фрагменты и случайно озвученные инструкции.
Примеры
Параметры
Текст
textТекст для синтеза.
ID голоса
voice_idИдентификатор голоса ElevenLabs.
ID модели
model_idИдентификатор модели ElevenLabs TTS.
Flash v2.5
Turbo v2.5
Многоязычный v2
v3
Формат вывода
output_formatВыходной формат ElevenLabs, передается как параметр запроса output_format.
mp3_22050_32
mp3_24000_48
mp3_44100_32
mp3_44100_64
mp3_44100_96
mp3_44100_128
mp3_44100_192
pcm_8000
pcm_16000
pcm_22050
pcm_24000
pcm_32000
pcm_44100
pcm_48000
ulaw_8000
alaw_8000
wav_8000
wav_16000
wav_22050
wav_24000
wav_32000
wav_44100
wav_48000
opus_48000_32
opus_48000_64
opus_48000_96
opus_48000_128
opus_48000_192
Код языка
language_codeНеобязательный код языка ISO для мультиязычных моделей.
Настройки голоса ElevenLabs
voice_settings