КупиГолос
Статьи

Генератор голоса ElevenLabs — Voice Design

Генератор голоса ElevenLabs позволяет не только выбирать готовые voices, но и создавать новый AI-голос через Voice Design.

Раздел скоро появится в сервисе

Ниже — инструкция по официальному ElevenLabs. Отдельный режим в КупиГолос пока не подтверждён. Кнопка открывает доступные инструменты сервиса.

Посмотреть инструменты КупиГолос
Микрофон и звуковая волна — иллюстрация синтеза речи
Voice Library

Выбрать готовый голос из каталога.

Voice Design

Создать новый синтетический голос по описанию.

Voice Cloning

Создать голосовой профиль по разрешённой записи.

Содержание инструкции

Что такое Voice Design

Пользователь описывает возраст, тембр, акцент, темп, эмоциональную подачу и характер речи, после чего ElevenLabs генерирует несколько вариантов для прослушивания. Выбранный Voice можно сохранить и затем использовать в Text to Speech и других совместимых инструментах.

Voice Design — инструмент ElevenLabs для создания уникального голоса из текстового промпта. В отличие от Voice Library, здесь голос не выбирают из каталога, а описывают словами. В отличие от Voice Cloning, аудиозапись реального человека не обязательна: система проектирует новый синтетический Voice по заданным характеристикам.

Как создать новый голос

  1. Откройте Voice Design

    Откройте Voices → My Voices → Add a new voice → Voice Design.

  2. Опишите голос

    Опишите голос. Укажите возраст, тип голоса, акцент, тембр, тон, скорость и манеру речи.

  3. Добавьте текст для превью

    Добавьте Text to preview — фрагмент, на котором удобно сравнивать дикцию, эмоции и характер.

  4. Создайте три варианта

    Нажмите Generate voice. ElevenLabs создаёт три варианта preview по одному описанию.

  5. Сравните результат

    Прослушайте три версии на одном и том же тексте. Сравните тембр, акцент, pacing, эмоциональность и разборчивость.

  6. Сохраните голос

    Выберите подходящий preview и сохраните его в My Voices. Сохранённый Voice занимает custom voice slot.

В официальной документации для Voice Design указаны описание голоса 20–1000 символов и preview text 100–1000 символов.

Как написать промпт для Voice Design

возраст + тип/пол голоса + акцент + тембр + высота + скорость + эмоциональная окраска + характер/роль + качество записи.

ПараметрЧто описыватьПример
Возрастyoung, middle-aged, elderlymiddle-aged male
Тембрwarm, husky, resonant, breathy, brightwarm resonant baritone
АкцентRussian, British, American, French и др.subtle Russian accent
Темпslow, conversational, fastcalm conversational pace
Эмоцияfriendly, stern, excited, melancholicconfident but warm
Рольnarrator, teacher, villain, assistant, characterdocumentary narrator
Качествоclean studio quality / intentionally roughclean studio-quality audio

Готовые примеры промптов

ЗадачаПример промпта
Документальный дикторA mature male documentary narrator with a deep warm baritone, neutral pacing, calm authority, clear diction and clean studio audio.
ОбучениеA friendly female teacher in her 30s, warm and patient, clear articulation, moderate pace, natural conversational delivery.
ПерсонажAn elderly mysterious wizard with a low raspy voice, slow theatrical pacing, dry humor and expressive breath.
Бренд / ассистентA confident gender-neutral brand voice, modern, calm, concise, medium pace, trustworthy and polished.

Русский язык

Созданный Voice можно использовать для русской речи через совместимые многоязычные модели ElevenLabs. Актуальный Eleven v3 поддерживает русский и ещё десятки языков. Для проверки нового голоса используйте preview-текст с именами, вопросом, длинной фразой и эмоциональным акцентом — так проще оценить дикцию и интонацию именно на русском.

Voice Design vs Library vs Cloning

ВариантЧто получает пользовательИсходные данныеКогда выбирать
Voice LibraryГотовый голос из каталогаНичего создавать не нужноНужен быстрый проверенный вариант.
Voice DesignНовый синтетический голосТекстовое описание + preview textНужен уникальный характер, которого нет в библиотеке.
Instant/Professional Voice CloningЦифровая модель существующего человекаАудиообразцы + требования к правам/верификацииНужно сходство с конкретным владельцем голоса.
Text to SpeechГотовая речь выбранным VoiceТекст + уже выбранный голосНужно озвучить текст, а не создавать голос.

Как выбрать лучший голос

  • Сравнивать все previews на одинаковом тексте.
  • Проверять не только приятность тембра, но и дикцию.
  • Добавить вопрос, перечисление и длинное предложение.
  • Если нужен персонаж, проверить эмоциональный фрагмент.
  • Для русского текста отдельно проверить имена, числа и ударения.
  • Сохранять Voice только после теста на реальном сценарии проекта.

Voice Design v3

Voice Design v3 создаёт голоса, совместимые с Eleven v3, и поддерживает более выразительные previews, включая audio tags. Сгенерированные голоса также обратно совместимы с моделями v2. ElevenLabs подчёркивает, что Voice Design остаётся экспериментальным: если для проекта уже существует подходящий Professional Voice Clone, он может дать более стабильное production-качество.

Дополнительные параметры Voice Design включают Loudness и Guidance Scale: первый регулирует громкость preview/сохранённого голоса, второй — насколько строго результат должен следовать prompt.

Где использовать созданный Voice

СценарийЧто проверить перед сохранением
Персонаж игрыЭмоции, акцент, резкие реплики, смех/вздохи.
АудиокнигаСтабильность тембра, спокойный pacing, длинные предложения.
ПодкастЕстественность разговорной подачи и пауз.
ОбучениеДикция, нейтральная эмоциональность, понятные акценты.
Брендовый голосУзнаваемость, повторяемость и соответствие tone of voice.
Видео / ReelsКороткие эмоциональные фразы и темп.

Доступ, скачивание и условия использования

Инструменты КупиГолос платные. Доступные режимы и стоимость указаны в интерфейсе сервиса. Описанные здесь функции ElevenLabs относятся к внешнему продукту: его подписка, экспорт и коммерческие условия проверяются отдельно. Используйте собственные записи, тексты и музыку либо материалы с необходимыми разрешениями. Возможность сгенерировать или скачать файл сама по себе не подтверждает права на его коммерческую публикацию.

Вопросы и ответы

Что такое генератор голоса ElevenLabs?

На этой странице под генератором понимается создание и выбор AI-голоса. Для уникального нового голоса используется Voice Design, для готового — Voice Library, а озвучка текста выполняется через TTS.

Как создать новый голос в ElevenLabs?

Откройте Voices → My Voices → Add a new voice → Voice Design, опишите нужный Voice, добавьте preview text, сгенерируйте три варианта и сохраните лучший.

Что такое ElevenLabs Voice Design?

Это генерация нового синтетического голоса по текстовому описанию без обязательного аудиообразца реального человека.

Сколько вариантов создаёт Voice Design?

Один запуск создаёт три voice previews, из которых можно выбрать и сохранить подходящий.

Что можно указать в описании голоса?

Возраст, акцент, тембр, тон, pacing, эмоцию, speaking style и желаемое качество звучания.

Можно ли сделать русский голос?

Сохранённые Voice Design-голоса совместимы с многоязычными моделями ElevenLabs, включая модели с поддержкой русского. Качество нужно проверять на русском preview/тестовом тексте.

Чем Voice Design отличается от клонирования?

Voice Design придумывает новый голос по описанию. Voice Cloning воспроизводит особенности существующего голоса по аудиозаписи.

Чем Voice Generator отличается от Text to Speech?

Voice Generator отвечает за выбор или создание Voice. Text to Speech использует уже выбранный Voice для чтения текста.

Какой голос лучше в ElevenLabs?

Универсально лучшего нет. Для диктора важны стабильность и дикция, для персонажа — характер и эмоции, для бренда — узнаваемость и повторяемость.

Инструменты КупиГолос

Доступные режимы и стоимость работы — в интерфейсе сервиса.

Перейти в сервис