Автонарезка вебинаров в ролики 9:16: открытая альтернатива Opus Clip
Открытый проект AI-Youtube-Shorts-Generator под лицензией MIT режет длинные вебинары, интервью и подкасты в вертикальные ролики 9:16: Whisper, выбор моментов языковой моделью, кадрирование по лицу. Разбираем, куда уходит видео, как с русским языком и чего проект не умеет.
Час вебинара и две недели нарезки
У эксперта, студии или школы лежит архив: вебинары по часу-полтора, интервью, записи подкастов. В Reels, Shorts и клипы из них попадает меньше процента. Причина понятная. Кто-то должен посмотреть запись, найти сильные минуты, вырезать, перевернуть кадр в вертикаль и держать лицо спикера по центру. Прикидка по моему опыту, не замер: на один час записи у монтажёра уходит от двух до четырёх часов, чтобы получить пять приличных роликов. Поэтому нарезку откладывают на потом, и архив годами лежит без дела.
Хороший ответ на эту боль: автонарезка с проверкой человеком. Машина предлагает кандидатов, человек выбирает лучшие. Один из самых заметных открытых проектов для этого называется AI-Youtube-Shorts-Generator. У названия много однофамильцев и копий, я разбираю оригинал Anil-matcha.
Что это за проект и что с лицензией
Проект позиционируется как открытая альтернатива Opus Clip, Vidyo.ai, Klap и SubMagic. На 5 октября 2026 у репозитория около 5 200 звёзд и 950 форков, код на Python. Авторов трое, почти все коммиты от одного. Последнее изменение вышло 29 сентября 2026. Отдельных релизов нет, ставится прямо из репозитория.
Про лицензию, потому что у многих таких проектов её нет совсем. Здесь файл LICENSE есть: MIT, автор Anil Chandra Naidu Matcha, год 2026. Появился он 10 сентября 2026, до этого в репозитории лицензии не было. MIT разрешает коммерческое использование, изменение и встраивание в свои продукты, нужно сохранить текст лицензии.
Как это работает по шагам
Конвейер такой. Видео расшифровывается Whisper с временными метками. Языковая модель определяет тип записи (подкаст, интервью, обучение) и выбирает кандидатов. Критерии зашиты в файл highlights.py: цепляющее начало, эмоциональный пик, яркое мнение, неожиданное признание, спор, цитата, польза. Каждому моменту модель ставит оценку от 0 до 100, пишет заголовок, первую фразу и причину выбора. Записи длиннее 30 минут режутся на куски по 20 минут с нахлёстом, пересекающиеся кандидаты отсеиваются, остаются лучшие. Дальше нарезка и кадрирование под нужное соотношение сторон.
На выходе mp4 и по желанию JSON с расшифровкой и всеми кандидатами. По JSON видно, какие отрезки машина отвергла.
Куда уходит ваше видео
Это главный вопрос для эксперта с платным контентом. У проекта два режима.
Режим api включён по умолчанию. Скачивание, расшифровку, подбор моментов и кадрирование делает внешний сервис MuAPI, он же продаёт собственный платный API нарезки. Нужен ключ этого сервиса, и ваше видео с текстом проходит через его серверы. В README на сервис есть заметная реклама, учитывайте это.
Режим local запускается флагом --mode local. Расшифровка идёт локально через faster-whisper, резка через ffmpeg, лицо ищет OpenCV. Файл можно передать обычным путём на диске, без YouTube. Наружу уходит только шаг выбора моментов: нужен ключ OpenAI или Gemini, и текст расшифровки уходит к ним. Для закрытого курса это стоит согласовать. Полностью офлайн проект сегодня не работает, локальной языковой модели там нет.
Железо, русский язык и кадрирование
Нужен Python 3.10 и ffmpeg. Размер модели Whisper задаётся переменной от tiny до large-v3, устройство auto, cpu или cuda. На обычном сервере без видеокарты работают маленькие модели, для большой нужна карта. Скорость я не замерял, цифр не даю.
С русским так. Whisper понимает русский, язык можно задать флагом --language ru. Качество расшифровки зависит от выбранной модели и от звука. Подбор моментов зависит от языковой модели, а критерии написаны под «вирусность». Для экспертного контента их придётся переписать: нужен законченный полезный фрагмент, а не скандальный. Нужен тест на ваших видео.
Кадрирование в локальном режиме делает каскад Хаара из OpenCV: находит самое крупное лицо в кадре и плавно ведёт по нему окно. Это простой метод, анфас он справляется, а с двумя спикерами в кадре или поворотом головы его надо проверять.
Что важно учесть
Субтитров на роликах нет. В описании и в коде резки я не нашёл наложения титров. В части форков заявлены анимированные субтитры, но это чужой код, я его не проверял. Подпись поверх ролика обычно делают отдельным шагом, про такие инструменты я писал в статьях про субтитры и нарезку архива и про MoneyPrinterTurbo. Отличие простое: MoneyPrinterTurbo собирает новый ролик из темы и стока, а этот проект режет ваше готовое длинное видео. Общий обзор инструментов есть в статье про нейросети для видео.
Второе ограничение: проект не доведён до продукта. Нет интерфейса просмотра, релизов, тестов качества. Ролики нельзя выпускать без просмотра: модель легко обрежет мысль на полуслове или выберет неудачный момент.
Третье, права. Нарезать можно свой контент или чужой с разрешения правообладателя. По статье 1270 ГК РФ воспроизведение и переработка произведения относятся к способам использования, которые принадлежат автору или иному правообладателю. Нарезка и перемонтаж подпадают под эти способы. Если в записи гость, лучше иметь его письменное согласие на ролики. Скачивать чужие видео с YouTube я не рекомендую: условия сервиса запрещают скачивать контент без разрешения YouTube или правообладателя. Берите свои исходники из записи вебинара, лучше как файл.
Что можно сделать уже сейчас
Первое. Возьмите три своих записи разного типа: вебинар, интервью, монолог.
Второе. Запустите локальный режим на копии файла, не на оригинале, и посмотрите JSON с кандидатами. Оцените, сколько из десяти предложенных моментов вы бы взяли сами. Если меньше трёх, дело в критериях выбора, их придётся настраивать.
Третье. Решите, готовы ли вы отдавать текст расшифровки в OpenAI или Gemini.
Четвёртое. Договоритесь, кто смотрит ролики перед выпуском. Десять минут проверки на ролик сильно дешевле двух часов монтажа.
Частые вопросы
Можно ли использовать проект для клиентов за деньги?
Да, лицензия MIT это допускает при условии сохранения текста лицензии. Права на сам видеоматериал это не решает, их нужно иметь отдельно.
Нужен ли платный ключ?
В режиме api нужен ключ MuAPI, в локальном ключ OpenAI или Gemini для выбора моментов.
Заменит ли он монтажёра?
Он заменит первый просмотр записи и черновую нарезку. Финальный выбор, титры и бренд остаются за человеком.
Коротко о главном
AI-Youtube-Shorts-Generator под лицензией MIT закрывает самую нудную часть: поиск кандидатов в длинной записи и вертикальное кадрирование. Он сырой, субтитров не делает, а по умолчанию отправляет видео внешнему сервису. Но как основа конвейера для вебинаров и подкастов годится.
Мы настраиваем конвейер нарезки под ваш контент и бренд: локальный запуск, критерии выбора моментов под вашу тему, субтитры в вашем стиле и проверка перед выходом. Подробности на странице перепаковки контента. Напишите мне в Telegram слово «ШОРТСЫ», и мы прогоним ваши записи через такой конвейер.
Ещё open-source для бизнеса
Эта статья — часть каталога бесплатных решений, которые я разворачиваю на вашем сервере под ключ: CRM, аналитика, документы, почта, безопасность, магазины, AI.
Что я делаю для бизнеса
- Боты в Telegram, MAX, VK
- Автоматизация процессов и CRM
- Аналитика и дашборды
- Сайты и лендинги под ключ
Бесплатно: чек-лист «Готов ли ваш бизнес к 152-ФЗ»
12 пунктов, которые проверяют готовность за час: данные, согласия, уведомление в РКН, локализация, защита. Отметьте, что уже сделано, и увидите дыры, за которые сейчас штрафуют.
Готовы обсудить вашу задачу?
Бесплатная консультация — разберём, как внедрить это в вашем бизнесе под ключ. Без форм, пишите напрямую.
Разборы, кейсы и практика — без воды. Выходит регулярно, читать 3–5 минут.


