Голос: спикеры и звук
Resemble Enhance
Модель улучшения речи: убирает шум и дорисовывает потерянные частоты, так что глухая запись звучит как студийная. Хороша для подготовки голоса к озвучке.
- Разработчик
- Resemble AI, США
- Первый выпуск
- дек 2023
- Последний выпуск
- дек 2023
- Размеры
- менее 1B
- Лицензия
- Можно в коммерциюMIT
Какие задачи решает
- Реставрация старых и телефонных записей
- Очистка голоса перед озвучкой и клонированием
- Улучшение звука в роликах и подкастах
Где применяется
Медиа и продакшнАрхивыОнлайн-обучение
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Resemble Enhance 0.0.1
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Голос: спикеры и звукDeepFilterNetХендрик Шретер (Университет Эрлангена) · ГерманияМожно в коммерцию
Лёгкое шумоподавление речи в реальном времени: работает даже на обычном процессоре и на слабых устройствах. Убирает гул, улицу, шум офиса, оставляя голос.
ПодробнееГолос: спикеры и звукClearerVoice (MossFormer)Alibaba (Tongyi Lab) · КитайМожно в коммерциюНабор моделей Alibaba для чистки речи: шумоподавление, разделение наложенных голосов, повышение качества звука до 48 кГц и выделение голоса по видео с лицом говорящего.
Подробнее

