Создать речь

Озвучка, копирование и замена голоса

Содержание

Здесь текст превращается в живую озвучку: возьмите готовый голос, скопируйте свой по короткому образцу, придумайте голос словами или замените голос в готовой записи.

Пригодится для роликов, аудиосообщений и озвучки постов. Три кнопки на входе — три разных инструмента, выбирайте по задаче.

🏠 Главное меню → 🎙 Создать речь

💥 Озвучить текст готовым голосом

Самый быстрый путь: вы даёте текст, выбираете голос — и получаете речь. Так делают закадровый текст, аудиоверсию поста или рекламный анонс.

Нажмите «✨ Gemini 3.1 Flash TTS», затем «📝 Изменить текст» и отправьте текст сообщением. Голос, стиль и темп меняются кнопками в любом порядке — когда всё устраивает, нажмите «🎙 Начать генерацию».

Настройки

🎙 Голос

  • Kore — стоит по умолчанию: ровный универсальный голос, с него удобно начать
  • Остальные двадцать девять — имена ничего не подсказывают, выбирают на слух: откройте «🎙 Голос: …» и послушайте примеры звучания

🎭 Стиль подачи

  • Обычный — когда важен только текст: инструкция, справка, черновик
  • Улыбка в голосе — приветствие, приглашение, доброжелательное объявление
  • Диктор — новости, объявления, корпоративное видео, обучающий ролик
  • Шёпот — интрига, страшная история, интимная подача
  • Участливый — поддержка, извинение, ответ на жалобу, бытовая тема
  • Промо / хайп — реклама, распродажа, анонс, динамичный рилс
  • Невозмутимый — сухой отчёт, технический текст, ирония с каменным лицом

⏩ Темп речи

  • Обычный — не трогайте, если не уверены
  • Естественный — разговорная подача: блог, подкаст, обращение к подписчикам
  • Скороговорка — короткий ролик, где нужно уложиться в несколько секунд
  • Плавно — медитация, аудиокнига, закадровый текст под медленный монтаж
  • Стаккато — акценты, перечисления, рубленые слоганы

Как написать текст

Текстовый запрос здесь — сам текст, который прозвучит; он же партитура: как напишете, так и произнесётся.

  • Знаки препинания и абзацы задают паузы и интонацию
  • «Ё» и точная орфография — правильное произношение
  • Числа словами: «две тысячи двадцать шестой», а не «2026»
  • Эмоции и звуки — в квадратных скобках: [laughing], [whispering], [sigh], [short pause]

Совет

Странное звучание чаще всего идёт не от голоса, а от текста: пропущенные запятые, «е» вместо «ё», цифры вместо слов. Минута вычитки меняет результат сильнее, чем смена голоса.

Пример: рекламный анонс

Стиль Промо / хайп, темп Скороговорка — так звучит реклама на радио.

Внимание, друзья! [short pause] Только три дня — большая весенняя распродажа.

Скидки до пятидесяти процентов на всю коллекцию, а на обувь — до семидесяти. Бесплатная доставка от трёх тысяч рублей, примерка на месте, возврат в течение двух недель.

Успейте до воскресенья: такие цены мы больше не повторим. Ждём вас с десяти утра и до девяти вечера.

Пример: объявление

Стиль Диктор, темп Естественный — для магазина, офиса или мероприятия.

Уважаемые гости, добрый день. Библиотека сегодня работает до восьми часов вечера.

Читальный зал на втором этаже закрыт на уборку с четырёх до пяти. Выдача и приём книг — окно номер два, слева от входа.

Записаться на экскурсию можно у администратора или по телефону: восемь, восемьсот, пятьсот пятьдесят пять, ноль один, ноль один. [short pause] Спасибо за внимание.

Если нужен не русский язык

Тот же сценарий, но на входе выберите «🐉 Qwen3 TTS Voice clone» и режим «🗣 Озвучка»: там есть кнопка «🌐 Русский» с десятью языками и свои девять голосов. Стиля и темпа здесь нет.

Ставьте язык текста, который озвучиваете, — от него зависят произношение и акцент.

Что получится

Сначала придёт голосовое — послушать прямо в чате, следом mp3 с подписью «Текст: …».

Под файлом две кнопки: «🔄 Варианты» — прочитать тот же текст заново, звучание будет другим; «✨ Новая озвучка» — начать сначала.

💥 Озвучить текст своим голосом

Когда нужен конкретный голос — ваш или из вашей записи. Подходит для серии роликов и для озвучки на языке, которым вы не владеете.

«🐉 Qwen3 TTS Voice clone» открывается сразу в режиме клонирования. Нажмите «📎 Образец» и пришлите короткую запись голоса, потом «📝 Изменить текст» и отправьте текст — дальше «🎙 Начать генерацию».

Образец голоса

  • Голосовое сообщение или аудиофайл: mp3, ogg, wav, m4a, flac, aac, opus
  • Длительность 5–15 секунд, один файл
  • Чистая речь: без музыки, шума, эха и чужих голосов на фоне

Настройки

Голос не выбирается — он целиком берётся из образца.

🎭 Режим

  • Клон голоса — по умолчанию: нужен именно ваш голос или голос из вашей записи
  • Озвучка — своей записи нет и хватит готового голоса из каталога
  • Голос по описанию — нужного голоса нет ни в каталоге, ни в записи

🌐 Язык

  • Русский — по умолчанию
  • English, Deutsch, Français, Español, Italiano, Português, 日本語, 한국어, 中文 — язык текста, который озвучиваете

Свой голос можно заставить говорить на чужом языке: образец по-русски, язык английский.

Совет

Из образца копируется не только тембр, но и эмоция, интонация, акцент и темп. Шёпот в образце даст шёпот в результате. Записывайте образец в том настроении, какое хотите услышать.

Пример: личное обращение

Текст с эмоциями в скобках: на нём слышно, что голос действительно ваш.

Привет! Это снова я, и у меня наконец-то есть новости. [short pause] Мы закончили курс: три месяца работы, сто двадцать уроков и целая гора переписанных конспектов. [laughing] Честно, я уже не верил, что доживу до этого дня.

[whispering] Первым десяти напишу отдельно. [sigh] Ладно, не буду тянуть: старт в понедельник, ссылка будет здесь же. Спасибо, что дождались.

💥 Придумать голос по описанию

Когда нужного голоса нет ни в каталоге, ни в записи: персонаж сказки, злодей ролика, типаж под бренд.

В «🐉 Qwen3 TTS Voice clone» нажмите «🎭 Режим: …» и выберите «🎨 Голос по описанию». Дальше «🎨 Описание» — присылаете описание голоса, «📝 Изменить текст» — сам текст, и «🎙 Начать генерацию».

Как описать голос

Описание голоса — тоже текстовый запрос: чем конкретнее, тем ближе результат. Держитесь порядка «пол → возраст → тембр → манера → темп → акцент».

Немолодой мужской голос, низкий и чуть хриплый, с прокуренной шершавинкой. Говорит медленно, с доброй усмешкой, будто рассказывает историю у костра поздним вечером. Долгие паузы между фразами, тёплая спокойная манера, к концу предложения голос заметно опускается. Без пафоса и без дикторской чеканки: речь простая, разговорная, с лёгким деревенским выговором.

И противоположный пример:

Молодой женский голос, звонкий и тёплый, чуть выше среднего. Дружелюбная разговорная манера, будто рассказывает подруге хорошую новость: лёгкая улыбка в голосе, живые интонации, короткие паузы перед главным словом. Темп быстрый, но каждое слово разборчиво. Без дикторской строгости и без наигранной рекламной подачи.

Язык выбирается той же кнопкой «🌐 Русский».

💥 Заменить голос в записи

Запись уже есть, но нужен другой тембр. Слова, интонация и паузы останутся вашими, сменится только голос. Текста для озвучки здесь нет.

Нажмите «🔄 RVC v2 (смена голоса)», затем «🎧 Исходная речь» и пришлите запись. Осталось выбрать «🎙 Голос: …», при необходимости «🎚 Тон: …» — и «🎙 Начать генерацию».

Исходная запись

  • Голосовое сообщение или аудиофайл, один файл
  • Длительность до 10 минут
  • Речь без музыки и второго голоса на фоне

Настройки

🎙 Голос

  • Голос из каталога — тот тембр, в который превратится запись; примеров звучания здесь нет, поэтому выбирают по названию
  • Не угадали — под готовым результатом есть «🎙 Другой голос»: та же запись, другой тембр

🎚 Тон

  • Исходный — пол исходного и целевого голоса совпадает
  • Муж → Жен — записано мужским голосом, целевой женский
  • Жен → Муж — наоборот

Важно

Если пол исходного и целевого голоса разный, а тон оставлен исходным, результат прозвучит роботизированно. Это единственная настройка, которую нельзя пропускать.

Что записать для пробы

Качество замены сильнее всего зависит от исходника. Начитайте вслух этот текст: ровный темп, микрофон близко.

Проверка записи: один, два, три. Говорю ровно, не спеша, микрофон держу близко.

Сегодня расскажу, как за один вечер собрать полку из четырёх досок, шести саморезов и одного очень упрямого шуруповёрта. Инструменты простые, опыт небольшой, но полка в итоге держится крепче, чем некоторые мои обещания.

Начнём с разметки и первого отверстия.

🎧 Каталог голосов

Кнопка «🎙 Голос: …» открывает каталог имён, а над ним проигрывается короткий пример звучания выбранного. Нажали имя — сразу слышно, как оно звучит; страницы листаются стрелками.

Слушайте тембр, темп речи и «улыбку» в голосе. Примеры есть у Gemini и у Qwen в режиме озвучки; в смене голоса каталог тоже есть, но без примеров.

🔥 Сильные стороны

Пунктуация работает как режиссура. Запятая, многоточие и абзац слышны, а скобки добавляют смех, вздох и паузу. Слышнее всего это на таком тексте — стиль Обычный, темп Плавно:

Дом стоял на самом краю посёлка, и по вечерам казалось, что дальше нет вообще ничего… только поле, туман и редкий свет чужих окон.

Я поднимался на второй этаж, садился у окна и слушал, как остывает крыша. [sigh] Тишина здесь была не пустой: она дышала, поскрипывала половицами, шуршала в водостоке.

Потом внизу хлопала калитка. [short pause] И я знал: сейчас на лестнице будут шаги.

Ваш голос — по короткому образцу. Одна запись на несколько секунд, и дальше этим голосом читается любой текст, в том числе на другом языке.

Голос, которого не существует. Персонажи для сказок, рекламные типажи, разные голоса для диалога — всё описывается словами.

Замена тембра без переозвучки. Дубль уже удачный, а голос нужен другой — переписывать ничего не придётся.

💡 Советы

  • Не понравилось звучание — сначала «🔄 Варианты». Те же слова прозвучат иначе, переписывать ничего не нужно.
  • Сначала кнопка, потом сообщение. Текст присылайте после «📝 Изменить текст», аудио — после «📎 Образец» или «🎧 Исходная речь».
  • Не то ударение — перепишите слово. Замените синонимом или поставьте перед ним паузу.
  • Длинный текст режьте по смыслу. Короткие куски звучат ровнее. И чем длиннее текст или запись, тем дороже генерация.
  • Образец записывайте в нужном настроении. Эмоция и темп копируются вместе с тембром.
  • Меняете пол голоса в записи — ставьте «🎚 Тон».
  • Аудио присылайте голосовым сообщением или аудиофайлом — так бот правильно видит длительность записи.

❓ Частые вопросы

Какой из трёх выбрать? Быстрая озвучка с настройкой подачи — «✨ Gemini 3.1 Flash TTS». Свой голос, придуманный голос или другой язык — «🐉 Qwen3 TTS Voice clone». Готовая запись, где надо сменить тембр, — «🔄 RVC v2 (смена голоса)».

Почему клон звучит не так, как я ожидал? Дело почти всегда в образце: фон, музыка и эхо переносятся в результат. Запишите 5–15 секунд чистой речи в нужном настроении.

Где у Qwen стиль и темп? Их там нет: они есть только у Gemini, а у Qwen вместо них язык. В смене голоса нет ни текста, ни языка, ни стиля.

Сколько ждать? Обычно несколько секунд. Сначала придёт голосовое, потом mp3.

🔗 Что почитать дальше

🎸 Создать песню · 💬 Чат с ИИ — там можно попросить нейросеть написать текст под озвучку · 🪙 Токены

Начните с пары предложений и трёх-четырёх голосов из каталога — этого хватит, чтобы понять, какой тембр вам ближе.

Первый дубль редко звучит идеально, и это нормально: послушайте, поправьте текст, нажмите «🔄 Варианты».