Текст → голос

Озвучка текста без студии в браузере

Обычный путь к синтезу речи — регистрация, веб-студия с дорожками и ползунками, генерация, скачивание файла, пересылка. @vustVoiceBot пропускает всё это: отправьте текст в переписку и получите аудиофайл в ответ. Язык определяется по самому тексту. Три озвучки в сутки — бесплатно.

Три озвучки в сутки бесплатно · дальше $0.10 · без регистрацииПредварительная версия модели · без клонирования голоса
Без регистрации и веб-студииТри озвучки в сутки бесплатноФайл WAV — пересылается как есть

Что здесь значит «бесплатно»

Что стоит знать до первой озвучки

Бесплатно — это три настоящие озвучки каждые сутки, без карты и без водяного знака, а не урезанный пробный период. Дальше $0.10 за штуку: цена названа заранее, списание происходит в момент отправки текста, отдельного шага подтверждения нет. Предел — 1000 символов, текст длиннее отклоняется честно и никогда не обрезается молча. На выходе файл WAV, а не голосовое сообщение с волной. Клонирования голоса здесь нет.

Синтез работает на предварительной версии модели: качество хорошее, но неотличимости от живой записи мы не обещаем.
Образцы

До и после

Короткий путь вместо привычного, слабое место русского синтеза и честные пределы.

Обычный путь и короткий

Как это устроено везде

Найти сервис, зарегистрироваться, попасть в веб-студию с дорожками и ползунками, разобраться в интерфейсе, сгенерировать, скачать файл, переслать его туда, где он нужен.

Что здесь

Отправили текст в переписку — получили аудиофайл в ответ. Он сразу лежит там, где им пользуются, и пересылается одним касанием. Язык определяется по самому тексту: русский звучит по-русски, английский — по-английски, переключать ничего не нужно.

Где синтез спотыкается по-русски

Слабое место

Ударения. Омографы вроде «за́мок» и «замо́к» и незнакомые имена собственные озвучиваются по вероятности, а не по смыслу фразы. Аббревиатуры, номера и даты читают то по буквам, то как слово.

Что с этим делать

Если текст пойдёт в публикацию, прослушайте его целиком, а при промахе переформулируйте: заменить слово надёжнее, чем надеяться, что во второй раз повезёт. Синтез работает на предварительной версии модели — качество хорошее, но обещать неотличимость от живой записи было бы неправдой.

Ограничения и цена

1000 символов на озвучку

Текст длиннее отклоняется честно, прямым отказом, — он никогда не обрезается молча. В озвучке молчаливое обрезание хуже отказа: вы узнаёте о нём, только дослушав файл до конца.

Сколько стоит

Три озвучки в сутки бесплатно, дальше $0.10 за штуку. Цена названа заранее, списание происходит в момент отправки текста — отдельного шага подтверждения нет; при сбое синтеза или доставки деньги возвращаются. Одна честность про бесплатный тариф: дневной слот занимается при запуске, поэтому неудачная бесплатная попытка израсходует одну из трёх.
Практические сценарии

Кому подходит озвучка в переписке

Тем, кто не хочет очередной регистрации
Нужен синтез речи, но не нужен ещё один веб-аккаунт и студия в браузере.
Учётной записью служит сам Telegram: отправили текст в @vustVoiceBot и получили файл.
Тем, кому это нужно изредка
Клип раз в неделю, а не подписка на месяц.
Три озвучки в сутки бесплатно, без карты и без водяного знака; дальше $0.10 за штуку, цена названа заранее.
Тем, кто работает с разными языками
Проверить, как строчка звучит на другом языке.
Язык определяется по самому тексту — выбирать вручную ничего не нужно, языкового переключателя просто нет.
Как это работает01–03

Как это работает

  1. 01

    Откройте @vustVoiceBot

    Ни веб-приложения, ни почты, ни пароля: вход — сам Telegram.

  2. 02

    Отправьте текст до 1000 символов

    Три озвучки в сутки бесплатно. Текст длиннее отклоняется честно и никогда не обрезается молча.

  3. 03

    Получите аудиофайл

    Файл WAV пересылается как любой другой. Голос и манеру можно выбрать один раз командой /voices — выбор запомнится.

Тот же инструмент · в Telegram@vustVoiceBot

Бесплатно, без регистрации, три раза в сутки

Откройте @vustVoiceBot и отправьте текст — учётной записью служит сам Telegram, заводить нечего.

Открыть в Telegram
Качество и доверие

Честные границы

Это файл, а не голосовое сообщение

На выходе обычный WAV, а не круглое голосовое с волной и встроенным плеером. Родного формата голосовых сообщений здесь нет.

Клонирования голоса нет

Четыре предустановленных голоса и три манеры — это весь диапазон. Загрузить образец речи и получить её копию нельзя, и это осознанное решение.

Ударения — слабое место

Омографы и незнакомые имена собственные озвучиваются по вероятности, а не по смыслу фразы. Перед публикацией текст стоит прослушать целиком: заменить слово надёжнее, чем надеяться на удачу.

FAQ

Частые вопросы

Что приходит в ответ — голосовое сообщение?

Нет, и это лучше знать заранее: приходит обычный аудиофайл в формате WAV, а не то круглое голосовое сообщение, которое Telegram рисует волной и проигрывает встроенным плеером. Родного формата голосовых сообщений здесь нет. Зато файл можно переслать, скачать, положить в монтаж или в презентацию.

Можно ли клонировать голос?

Нет, и это осознанное решение, а не «пока не сделали». Загрузить образец чужой или своей речи и получить её копию нельзя — такой функции не существует. Доступны четыре предустановленных голоса и три манеры речи: выбор делается один раз командой /voices и применяется ко всем следующим озвучкам.

Нужно ли выбирать язык?

Нет, выбирать нечего: 24+ языка определяются автоматически прямо из вставленного текста. Русский текст звучит по-русски, английский — по-английски, переключателя нет ни на одном шаге.

Насколько хорошо звучит русская речь?

Достаточно хорошо для прослушивания, черновой дорожки и проверки текста на слух. Слабое место у синтеза одно и предсказуемое — ударения: омографы и незнакомые имена собственные озвучиваются по вероятности, а не по смыслу фразы; аббревиатуры, номера и даты читаются то по буквам, то как слово. Перед публикацией текст стоит прослушать целиком.

Какой предел длины?

1000 символов на одну озвучку. Текст длиннее отклоняется прямым отказом и никогда не обрезается молча — в озвучке это важнее, чем в тексте: про молчаливое обрезание вы узнаёте, только дослушав файл до конца.

Сколько это стоит?

Три озвучки в сутки бесплатно, дальше $0.10 за штуку. Цена названа заранее, а списание происходит в момент отправки текста: отдельного шага подтверждения нет. Если синтез или доставка сорвутся, деньги возвращаются. Отдельная честность про бесплатный тариф: дневной слот занимается ещё до обращения к синтезу, поэтому неудачная бесплатная попытка израсходует одну из трёх.

Когда лучше выбрать что-то другое?

Если нужен именно формат голосового сообщения с волной и встроенным проигрывателем — здесь его нет. Если нужен собственный голос, эмоциональная игра или профессиональная озвучка — это студийная задача, и предварительная версия модели её не закрывает. Если текст длиннее тысячи символов и делить его не хочется — это тоже не сюда.

Можно начинать

Озвучка текста без аккаунта и без студии.

Три озвучки в сутки, без карты и без интерфейса, который надо осваивать. Дальше $0.10 за штуку, цена названа заранее.

Текст вслух, без студии в браузере

Обычный путь к синтезу речи выглядит так: найти сервис, зарегистрироваться, попасть в веб-студию с дорожками и ползунками, разобраться в интерфейсе, сгенерировать, скачать файл, переслать его туда, где он нужен.

Здесь короче: отправить текст в переписку — получить аудиофайл в ответ. Файл сразу лежит там, где им пользуются, и пересылается одним касанием.

Что именно приходит

Аудиофайл в формате WAV. Это важное уточнение, и лучше знать его заранее: это не то круглое голосовое сообщение, которое Telegram рисует волной и проигрывает встроенным плеером. Это обычный файл — его можно переслать, скачать, положить в монтаж или в презентацию. Родного формата голосовых сообщений здесь нет.

Язык определяется по тексту. Русский текст звучит по-русски, английский — по-английски, и переключать ничего не нужно: языкового параметра в запросе к модели нет вообще, она определяет язык по тексту. Сколько именно языков она узнаёт — её свойство, а не наша настройка, и мы это число не называем.

Голос и манера выбираются один раз. Команда /voices открывает выбор из четырёх голосов и трёх манер речи. Выбор запоминается и применяется ко всем следующим озвучкам, пока вы его не смените.

Что честно сказать о качестве

Синтез работает на предварительной версии модели. Это не оговорка ради оговорки: означает, что качество хорошее, но обещать неотличимость от живой записи было бы неправдой, и мы этого не обещаем.

Русская речь у синтеза традиционно уязвима в одном месте — ударения. Омографы («за́мок» и «замо́к», «бо́льшая» и больша́я») и незнакомые имена собственные озвучиваются по вероятности, а не по смыслу фразы. Если текст пойдёт в публикацию, прослушайте его целиком и при промахе переформулируйте: заменить слово надёжнее, чем надеяться, что во второй раз повезёт.

Аббревиатуры, номера и даты тоже стоит проверить: их читают то по буквам, то как слово, и предсказать это по тексту нельзя.

Клонирования голоса здесь нет

Сознательно. Загрузить образец чужой или своей речи и получить её копию нельзя — такой функции не существует, а не «пока не сделали».

Доступны четыре предустановленных голоса. Этого достаточно для озвучки текста, заметок вслух и черновой дорожки, и недостаточно для того, чтобы говорить чужим голосом.

Ограничения и цена

1000 символов на одну озвучку. Текст длиннее отклоняется честно, с прямым отказом, — он никогда не обрезается молча. Молчаливое обрезание в озвучке хуже отказа: вы узнаёте о нём, только дослушав файл до конца.

Три озвучки в сутки — бесплатно. Дальше $0.10 за штуку. Цена названа заранее, а списание происходит в момент отправки текста: отдельного шага подтверждения нет. Если синтез или доставка сорвутся, деньги возвращаются.

Одна честность про бесплатный тариф: дневной слот занимается в момент запуска, ещё до обращения к синтезу. То есть неудачная бесплатная попытка израсходует одну из трёх. Это неприятно, зато сказано прямо, а не обнаружено вами на третьей попытке.

Когда этим удобно пользоваться

  • Длинный текст, который проще прослушать. Статья, заметка, конспект — по дороге, за рулём, во время дел.
  • Черновая озвучка. Дорожка для ролика или презентации, чтобы услышать хронометраж и ритм до записи живого голоса.
  • Проверка текста на слух. Написанное читается иначе, чем звучит: неудобные обороты и слишком длинные предложения слышны сразу.
  • Отправить голосом, когда неудобно записывать. Файл пересылается, как любой другой.

Когда лучше выбрать другое

Если нужен именно формат голосового сообщения с волной и встроенным проигрывателем — здесь его нет.

Если нужен собственный голос, эмоциональная игра или профессиональная озвучка — это студийная задача, и предварительная версия модели её не закрывает.

Если текст длиннее тысячи символов и делить его не хочется — это тоже не сюда.