КупиГолос
Статьи

ElevenLabs Voice Changer — как изменить голос в аудио

ElevenLabs Voice Changer меняет голос в уже записанной речи, сохраняя содержание и исполнительскую подачу: эмоции, интонации, паузы, темп, акцент, шёпот и другие нюансы.

Раздел скоро появится в сервисе

Ниже — инструкция по официальному ElevenLabs. Отдельный режим в КупиГолос пока не подтверждён. Кнопка открывает доступные инструменты сервиса.

Посмотреть инструменты КупиГолос
Микрофон и звуковая волна — иллюстрация синтеза речи
Содержание инструкции

Что такое Voice Changer

Пользователь записывает или загружает аудио, выбирает целевой Voice и получает новую версию той же реплики другим голосом. Раньше функция называлась Speech to Speech.

Voice Changer — это voice conversion, а не Text to Speech. Исходником служит не текст, а готовое речевое исполнение. ElevenLabs переносит его на другой Voice, сохраняя характер произнесённой реплики. Целевым голосом может быть Voice из библиотеки, собственный cloned Voice или заранее созданный designed Voice.

Как изменить голос в ElevenLabs

  1. Откройте Voice Changer

    Откройте Voice Changer в ElevenCreative.

  2. Загрузите или запишите речь

    Запишите реплику прямо в интерфейсе или загрузите аудио/видео с речью.

  3. Выберите целевой голос

    Выберите целевой Voice из библиотеки либо используйте собственный совместимый Voice.

  4. Выберите модель Speech-to-Speech

    Для русского и других поддерживаемых языков используйте Multilingual Speech-to-Speech; актуальная документация рекомендует eleven_multilingual_sts_v2.

  5. Настройте шумоподавление

    Если в записи есть гул или посторонний фон, включите Remove Background Noise.

  6. Преобразуйте и сравните запись

    Запустите преобразование и сравните исходник с результатом: слова, паузы, акцент, эмоции и тайминг должны сохраниться, а тембр — измениться.

Что сохраняется при замене голоса

Элемент исходникаЧто ожидать
СловаСодержание речи сохраняется; Voice Changer не переписывает сценарий.
ЭмоцииКрик, смех, плач, шёпот и эмоциональная окраска могут переноситься в целевой Voice.
ИнтонацияВопросительность, акценты и мелодика исходного исполнения остаются важной частью результата.
Паузы и timingРитм и длительность исходной реплики в основном сохраняются.
АкцентИсходный акцент и манера произношения влияют на output.
Тембр / identityМеняется на выбранный целевой Voice.

Русский язык

Модель eleven_multilingual_sts_v2 поддерживает 29 языков, включая русский. Язык и акцент задаются самой исходной записью: если человек говорит по-русски, Voice Changer преобразует эту русскую речь другим голосом. Выбор англоязычного Voice сам по себе не переводит содержание на английский.

Как подготовить исходную запись

  • Записывать в тихом помещении без заметного эха.
  • Не делать сигнал слишком тихим и избегать клиппинга.
  • Говорить с той эмоцией и темпом, которые нужны в финальной версии.
  • Для сложной сцены записать смех, шёпот, вздох или акцент естественно — не пытаться добавлять их потом текстовыми командами.
  • Перед длинной обработкой проверить 15–30 секунд на одном целевом Voice.

Background Noise

Voice Changer умеет автоматически уменьшать фоновый шум. В веб-интерфейсе это отдельная настройка Remove Background Noise, а в API — параметр remove_background_noise=true. Шумоподавление полезно при лёгком гуле или бытовом фоне, но сильно повреждённая запись всё равно может дать артефакты.

Лимит 5 минут

Текущий максимальный сегмент Voice Changer — 5 минут, одинаково для всех подписок. Более длинные интервью, лекции и аудиокниги нужно делить на части, а после преобразования проверять стыки: громкость, тембр и фон между сегментами не должны заметно меняться.

На официальном Voice Changer landing также указан лимит до 50 MB на загружаемый audio/video файл.

API и streaming

В ElevenAPI функция по-прежнему использует route speech-to-speech. Для запроса передаются исходное audio, voice_id целевого голоса и model ID. Есть обычный и streaming endpoint. Streaming позволяет получать преобразованное аудио по мере обработки, но это не готовый «живой микрофон для Discord» или универсальный real-time changer.

Voice Changer vs другие функции

ФункцияВходЧто меняетсяКогда использовать
Voice ChangerЗаписанная речьКто говорит; сохраняется исполнениеНужен другой Voice без повторной актёрской записи.
Text to SpeechТекстСоздаётся новое исполнение выбранным голосомНужно озвучить сценарий с нуля.
Voice CloningАудиообразец человекаСоздаётся многоразовый Voice-профильНужно воспроизводить конкретный разрешённый голос.
Voice DesignТекстовое описание голосаСоздаётся новый синтетический VoiceНужен уникальный голос, которого ещё нет.
Voice IsolatorШумная записьОчищается речь от фонового звукаНужна очистка, а не смена спикера.
DubbingВидео/аудио + язык переводаМеняются язык и голосовая дорожкаНужна локализация на другой язык.

Real time и live

ElevenLabs предоставляет streaming API для преобразования, однако это не то же самое, что виртуальный микрофон с гарантированно низкой задержкой. Для real-time сценариев нужно отдельно проектировать приложение и измерять latency.

Voice Changer и Eleven v3

Eleven v3 — актуальная выразительная Text to Speech модель, но Voice Changer использует отдельные Speech-to-Speech модели. В текущей документации для Voice Changer рекомендована eleven_multilingual_sts_v2; это отдельная модель, не Eleven v3.

Стоимость и кредиты

Voice Changer тарифицируется по длительности обработанного аудио. В актуальном product guide ElevenLabs расчёт указан как эквивалент 1000 символов за одну минуту обработки.

Права и согласие

Выбирайте собственный Voice, лицензированный голос из библиотеки или профиль, на использование которого есть разрешение. Voice Changer не даёт прав выдавать себя за другого человека. Для коммерческого проекта отдельно проверяйте условия выбранного Voice, подписки ElevenLabs и права на исходную аудиозапись.

Доступ, скачивание и условия использования

Инструменты КупиГолос платные. Доступные режимы и стоимость указаны в интерфейсе сервиса. Описанные здесь функции ElevenLabs относятся к внешнему продукту: его подписка, экспорт и коммерческие условия проверяются отдельно. Используйте собственные записи, тексты и музыку либо материалы с необходимыми разрешениями. Возможность сгенерировать или скачать файл сама по себе не подтверждает права на его коммерческую публикацию.

Вопросы и ответы

Что такое ElevenLabs Voice Changer?

Это инструмент Speech-to-Speech для преобразования уже записанного голоса в другой Voice с сохранением эмоций, интонации, пауз и timing.

Как поменять голос в ElevenLabs?

Загрузите или запишите речь, выберите целевой Voice, при необходимости включите Remove Background Noise и запустите преобразование.

Работает ли Voice Changer на русском?

Да. eleven_multilingual_sts_v2 поддерживает русский и ещё 28 языков.

Переводит ли Voice Changer русский голос на английский?

Нет. Он сохраняет содержание и язык исходной речи. Для перевода на другой язык используйте Dubbing.

Можно ли использовать свой cloned Voice?

Да. Официальная документация разрешает использовать совместимые cloned или designed voices как target Voice.

Сколько минут можно обработать за один раз?

Максимальная длина одного сегмента — 5 минут. Длинные записи нужно разбивать.

Можно ли убрать фоновый шум?

Да. Voice Changer поддерживает Remove Background Noise; в API используется remove_background_noise=true.

Voice Changer работает в реальном времени?

Есть streaming API, но это не готовый системный real-time voice changer для звонков. Для live-сценария требуется отдельная интеграция и проверка задержки.

Voice Changer работает на Eleven v3?

Не как основная STS-модель. Для Voice Changer текущая документация рекомендует eleven_multilingual_sts_v2.

Чем Voice Changer отличается от клонирования?

Клонирование создаёт Voice-профиль. Voice Changer использует уже существующий Voice как цель и переносит на него готовое исполнение.

Можно ли менять голос в пении?

Voice Changer ориентирован на речь. Для пения нужен отдельный тест: успешное преобразование разговорного голоса не гарантирует качество вокала.

Этот режим уже работает в КупиГолос?

Отдельный режим пока не подтверждён. Здесь описан порядок работы во внешнем сервисе; кнопки открывают доступные инструменты КупиГолос.

Инструменты КупиГолос

Доступные режимы и стоимость работы — в интерфейсе сервиса.

Перейти в сервис