Речь в текст

Omnilingual ASR

Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.

Разработчик
Meta, США
Первый выпуск
ноя 2025
Последний выпуск
дек 2025
Размеры
300M – 7B
Лицензия
Можно в коммерциюApache 2.0

Какие задачи решает

  • Расшифровка на редких и местных языках
  • Оцифровка устных архивов
  • Субтитры на многих языках
  • Голосовые сервисы для малых языков

Где применяется

Госсектор и регионыМузеи и архивыМедиаОбразование

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Omnilingual ASR v2 и Unlimited
  2. Omnilingual ASR (CTC, LLM, W2V)

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели