AuK
Одна открытая модель на все задачи с речью: синтез и клонирование голоса, правка слов и интонации в готовой записи, шумоподавление, отделение вокала. Команды пишутся обычным текстом.
Клонировать голос можно только с согласия владельца голоса. Запись чужого голоса без разрешения и выдача её за подлинную — это отдельный риск, юридический и репутационный; порядок согласования лучше обсудить с юристом.
- Разработчик
- Tencent Hunyuan, Китай
- Первый выпуск
- сен 2026
- Последний выпуск
- сен 2026
- Размеры
- 1,5B
- Лицензия
- Можно в коммерциюMIT
- Русский язык
- Не заявлен
- Запуск
- Через свой серверНужна видеокарта
- Сферы
- Медиа и продакшн, Маркетинг и контент
Какие задачи решает
- озвучка текста и клонирование голоса по образцу
- правка слов и интонации без перезаписи фразы
- шумоподавление и очистка записи
- отделение голоса или вокала от фона
Где применяется
Требования к железу
Версии
- AuK-Flash (4 шага вместо 32)
- AuK
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать AuK в коммерческом проекте?
Да. Лицензия: MIT. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для AuK?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли AuK русский язык?
В карточке модели языки не перечислены, поэтому поддержку русского обещать нельзя — её нужно проверять на ваших примерах.
Где скачать AuK и сколько это стоит?
Веса AuK лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модель клонирования голоса по нескольким секундам образца, английский и китайский. Сообщество выпустило много дообученных версий под другие языки, в том числе русский.
ПодробнееСинтез речиFish Speech / OpenAudioFish Audio · США / КитайТолько некоммерческоеСинтез речи с клонированием голоса и управлением эмоциями на 80+ языках, включая русский. Качество близко к платным сервисам, но веса только для исследований.
ПодробнееСинтез речиCosyVoice / Fun-CosyVoiceAlibaba (Tongyi, FunAudioLLM) · КитайМожно в коммерциюСинтез речи с клонированием голоса по короткому образцу и потоковой выдачей для живого диалога. Третья версия поддерживает 9 языков, включая русский.
ПодробнееИсточник: huggingface.co/tencent/AuK. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


