Синтез речи

Piper

Очень быстрый синтез речи, который работает даже на Raspberry Pi. Готовые голоса на 35+ языках, есть несколько русских.

Разработчик
Rhasspy / Open Home Foundation, США
Первый выпуск
июн 2023
Последний выпуск
мар 2025
Размеры
около 5M – 30M
Лицензия
Коммерция с условиямиСтарый движок MIT, новый piper1-gpl — GPL-3.0; у каждого голоса своя лицензия (есть свободные и некоммерческие)

Какие задачи решает

  • Озвучка уведомлений и ответов бота
  • Голос для устройств без интернета
  • Голосовые меню
  • Чтение текста вслух

Где применяется

Умный домВстраиваемые устройстваГолосовые ботыТерминалы и киоски

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. piper1-gpl (новая ветка движка)
  2. Piper и первые голоса

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели