Синтез речи
Kokoro
Крошечная модель синтеза речи (82M), которая звучит на уровне крупных. Работает на обычном процессоре; английский и ещё несколько языков, русского нет.
- Разработчик
- hexgrad (независимый разработчик), не указана
- Первый выпуск
- дек 2024
- Последний выпуск
- фев 2025
- Размеры
- 82M
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Озвучка статей и уведомлений
- Голос для приложений без видеокарты
- Массовая озвучка текстов
Где применяется
Мобильные и веб-приложенияМедиаОнлайн-обучение
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Kokoro v1.1-zh
- Kokoro v1.0
- Kokoro v0.19
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиPiperRhasspy / Open Home Foundation · СШАКоммерция с условиями
Очень быстрый синтез речи, который работает даже на Raspberry Pi. Готовые голоса на 35+ языках, есть несколько русских.
ПодробнееСинтез речиStyleTTS 2Колумбийский университет · СШАКоммерция с условиямиЛёгкая модель синтеза английской речи с естественной интонацией. На её основе построены многие другие модели, например Kokoro.
ПодробнееСинтез речиChatterboxResemble AI · СШАМожно в коммерциюСинтез речи с клонированием голоса и настройкой эмоциональности. Многоязычная версия поддерживает 23 языка, включая русский; Turbo и Flash ускорены для живого диалога.
Подробнее

