Речь в текст
Omnilingual ASR
Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.
- Разработчик
- Meta, США
- Первый выпуск
- ноя 2025
- Последний выпуск
- дек 2025
- Размеры
- 300M – 7B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Расшифровка на редких и местных языках
- Оцифровка устных архивов
- Субтитры на многих языках
- Голосовые сервисы для малых языков
Где применяется
Госсектор и регионыМузеи и архивыМедиаОбразование
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Omnilingual ASR v2 и Unlimited
- Omnilingual ASR (CTC, LLM, W2V)
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Речь в текстWhisperOpenAI · СШАМожно в коммерцию
Распознавание речи на 99 языках, включая русский. Стандарт де-факто для расшифровки звонков и встреч.
ПодробнееГолосовые ассистентыSeamlessM4T / SeamlessMeta · СШАТолько некоммерческоеПеревод речи и текста примерно между сотней языков, включая русский: речь в текст, речь в речь, потоковый перевод с сохранением интонации.
ПодробнееРечь в текстQwen3-ASRAlibaba (Qwen) · КитайМожно в коммерциюМодели распознавания речи от команды Qwen на 50+ языков, включая русский. Хорошо справляются с шумом, пением и акцентами.
Подробнее

