Распознавание карельской речи (Mihaj)
Два десятка дообучений Whisper, wav2vec2 и WavLM под карельский язык, в том числе под записи, где человек переходит с карельского на русский. Карточки моделей пустые, качество надо проверять на своих записях.
- Разработчик
- Mihaj Dolgushin, не раскрыта
- Первый выпуск
- фев 2024
- Последний выпуск
- ноя 2025
- Размеры
- от 300M до 1B в разных моделях
- Лицензия
- Коммерция с условиямина карточках моделей лицензия не указана — уточняйте у разработчика
- Русский язык
- Есть
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Медиа и продакшн, Образование, Наука, Госсектор
Какие задачи решает
- Расшифровка полевых и архивных записей на карельском
- Субтитры к материалам на карельском языке
- Работа с записями, где смешаны карельский и русский
- Основа для дообучения под свой диалект
Где применяется
Требования к железу
Версии
- wav2vec2-BERT для карельского с русским
- Whisper large-v3-turbo для карельского
- Distil-Whisper large-v2 для карельского
- Whisper medium, финский и карельский
- wav2vec2 XLS-R для карельского
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать Распознавание карельской речи (Mihaj) в коммерческом проекте?
С условиями. Лицензия: на карточках моделей лицензия не указана — уточняйте у разработчика. Ограничения бывают разными — регион, выручка компании, требование указывать авторство. Перед коммерческим запуском проверьте условия с юристом.
Какое железо нужно для Распознавание карельской речи (Mihaj)?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли Распознавание карельской речи (Mihaj) русский язык?
Да, русский язык заявлен в карточке модели.
Где скачать Распознавание карельской речи (Mihaj) и сколько это стоит?
Веса Распознавание карельской речи (Mihaj) лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Распознавание речи на 99 языках, включая русский. Стандарт де-факто для расшифровки звонков и встреч. Ускоренные Distil-Whisper от Hugging Face — только для английского.
ПодробнееРечь в текстMMS (Massively Multilingual Speech)Meta AI · СШАТолько некоммерческоеРечевые модели Meta более чем на тысячу языков. В списке поддержки есть башкирский, татарский, чувашский, якутский, осетинский, чеченский, аварский, удмуртский, марийский, эрзянский, мокшанский, калмыцкий и карельский. Качество по языкам очень разное, проверять надо на своих записях.
ПодробнееРечь в текстРаспознавание речи для башкирского, татарского и марийского (AigizK)Айгиз Кунафин (AigizK), участник сообщества SLONE · РоссияКоммерция с условиямиМноголетняя работа одного энтузиаста вокруг башкирского Common Voice: дообучения Whisper, wav2vec2, w2v-BERT и GigaAM под башкирский, татарский и марийский языки. Качество у моделей разное, проверять надо на своих записях.
ПодробнееИсточник: huggingface.co/Mihaj/wav2vec2-bert-karelian-cs-w-rus-full-ft. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


