Перейти к содержимому
Новость

pierrenade/short-video-generator-AI сам ищет фрагменты YouTube-видео для Shorts

На GitHub появился открытый pierrenade/short-video-generator-AI, который берет исходное видео, расшифровывает речь и с помощью языковой модели выбирает фрагменты для коротких вертикальных роликов. Сам проект бесплатный, но для анализа требуется API-ключ OpenAI, Gemini или MuAPI.

Анатолий В.
pierrenade/short-video-generator-AI сам ищет фрагменты YouTube-видео для Shorts

Автор: pierrenade

Главная идея проекта не в обычной автоматической нарезке по времени. pierrenade/short-video-generator-AI сначала получает расшифровку ролика через faster-whisper, затем определяет тип контента и передает текст выбранной языковой модели. Она ищет фрагменты с сильным началом, эмоциональными моментами, конфликтом, полезной информацией или законченным сюжетом, после чего кандидаты ранжируются и пересекающиеся отрезки удаляются.
На выходе программа рендерит выбранные эпизоды в заданном формате. По умолчанию создаются три ролика, стандартное соотношение сторон для Shorts составляет 9:16. Можно использовать ссылку YouTube или локальный видеофайл, менять число фрагментов и разрешение исходника, а также отключать автоматически созданную вступительную фразу.
Работает все локально через Python 3.10 или новее. Есть командная строка и локальный веб-интерфейс, в котором можно ставить в очередь несколько видео. Это отличает проект от типичного облачного сервиса: само видео обрабатывается на компьютере пользователя, а внешняя языковая модель нужна для анализа расшифровки и выбора фрагментов.
Полностью бесплатным такой вариант можно назвать только с оговоркой. Код распространяется по лицензии MIT, но OpenAI и MuAPI требуют платного API. В документации проекта для Gemini указан бесплатный уровень с дневным лимитом. Поэтому отсутствие подписки на сервис монтажа еще не означает отсутствие расходов при постоянной обработке большого числа роликов.
В описании репозитория также заявлены субтитры, перевод и озвучка. Однако подробный раздел с рабочим процессом в текущем README в первую очередь описывает расшифровку, анализ, выбор фрагментов и автоматическое кадрирование. Отдельных опубликованных тестов качества поиска удачных моментов у проекта пока нет, поэтому утверждение о способности находить именно «вирусные» фрагменты остается заявлением автора, а не проверенным результатом.
На странице GitHub сейчас нет оформленных релизов, поэтому проект выглядит как молодой рабочий репозиторий, а не готовая программа с установщиком и стабильными версиями. Для человека, который регулярно превращает длинные интервью, подкасты или записи в Shorts, практическая польза понятна: ручной просмотр всего исходника можно заменить расшифровкой и предварительным автоматическим отбором эпизодов. Но окончательное решение о том, какой фрагмент действительно стоит публиковать, пока разумнее оставлять человеку.

Источник: GitHub