Речь в текст
Moonshine
Очень маленькие и быстрые модели распознавания речи для телефонов, планшетов и встраиваемых устройств. Вторая версия работает потоково и выдаёт текст, пока человек ещё говорит.
- Разработчик
- Moonshine AI (Useful Sensors), США
- Первый выпуск
- окт 2024
- Последний выпуск
- авг 2026
- Размеры
- 27M – 245M
- Лицензия
- Можно в коммерциюMIT; исключение — старые непотоковые модели для языков кроме английского (некоммерческая Moonshine Community License)
Какие задачи решает
- Голосовое управление устройствами
- Распознавание на телефоне без интернета
- Живые субтитры
- Голосовые интерфейсы в приложениях
Где применяется
Производители устройствМобильные приложенияУмный домКиоски и терминалы
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Потоковые модели для других языков
- Moonshine v2 (потоковая)
- Moonshine Tiny / Base
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Речь в текстWhisperOpenAI · СШАМожно в коммерцию
Распознавание речи на 99 языках, включая русский. Стандарт де-факто для расшифровки звонков и встреч.
ПодробнееРечь в текстNVIDIA Parakeet / Canary / Nemotron SpeechNVIDIA · СШАКоммерция с условиямиБыстрые модели распознавания речи от NVIDIA, в том числе потоковые для работы в реальном времени. Parakeet TDT v3 и Nemotron 3.5 ASR понимают русский.
Подробнее

