Озвучить текст нейросетью можно в чате ИИ-адаптер: вставляете текст, выбираете голос — и модель произносит его дословно, с естественными интонациями. У Gemini TTS десятки голосов с разными характерами, русский язык поддерживается. Работает из России без VPN; оплата в рублях за объём озвученного текста, подписки нет.
Как это работает
- Откройте чат и нажмите пресет «Сгенерировать речь» — включится режим озвучки с панелью выбора голоса.
- Вставьте текст, который нужно озвучить. Модель произнесёт его дословно — без пересказа и отсебятины.
- Выберите голос из списка (у каждого — короткое описание характера: спокойный, энергичный, «дикторский») и отправьте.
- Готовое аудио появится в чате: его можно прослушать и скачать.
Какие модели озвучивают текст
| Модель | Голоса | Вход / 1М |
|---|---|---|
| CCanopy Labs: Orpheus 3B | 7 | 884,45 ₽ |
| DDeepgram: Aura-2 | 90 | 3 790,5 ₽ |
| 30 | 126,35 ₽ | |
| Hhexgrad: Kokoro 82M | 54 | 78,34 ₽ |
| 4 | 2 779,7 ₽ | |
| 4 | 1 895,25 ₽ | |
| — | 12 635 ₽ | |
| — | 7 581 ₽ | |
| 30 | 2 021,6 ₽ | |
| 2 | 1 895,25 ₽ | |
| 2 | 2 527 ₽ | |
| SSesame: CSM 1B | 7 | 884,45 ₽ |
| 5 | 1 895,25 ₽ | |
| ZZyphra: Zonos v0.1 Hybrid | 5 | 884,45 ₽ |
| ZZyphra: Zonos v0.1 Transformer | 5 | 884,45 ₽ |
Для русского языка хороший выбор по умолчанию — Gemini TTS: мультиязычная модель с десятками голосов. Тарификация — за токены входного текста: короткая реплика стоит копейки, часовая аудиокнига — уже заметнее; итог каждой генерации виден в чате.
Где это пригодится
- Озвучка видео: закадровый голос для роликов, рилсов и обучающих курсов.
- Подкасты и аудиостатьи: превратите текстовый пост в аудиоверсию.
- Прослушивание длинных текстов: договор или конспект удобнее слушать в дороге.
- Прототипы IVR и голосовых ботов: быстро проверить, как звучат реплики (для продакшена есть API).
Вопросы и ответы
Есть ли русские голоса?
Да. Gemini TTS — мультиязычная модель: любой из её голосов читает русский текст с естественным произношением. Описания характеров голосов видны при выборе в чате.
Модель читает точно по тексту?
Да, режим озвучки передаёт модели текст дословно — она не пересказывает и не дополняет его. Ударения и паузы можно подсказать пунктуацией.
Сколько стоит озвучка?
Оплата за объём текста (токены). Порядок цен: абзац — копейки, страница — единицы рублей. Точные тарифы — в таблице выше и на страницах моделей.
Можно ли озвучивать через API?
Да, тот же функционал доступен методом /audio/speech — см. документацию. Удобно для автоматической озвучки статей или уведомлений.