상세 설명
영상 폴더를 지정하면 음성을 텍스트로 옮기고 어떤 장면이 있는지 정리한 뒤 편집 방향을 제안합니다. 승인하면 잘라 붙인 결과물을 만들어 원본 옆 edit 폴더에 둡니다. 저는 기본 전사 백엔드를 Groq의 whisper 모델로 바꿔서 쓰고 있습니다.
장점
- 긴 촬영본에서 쓸 구간을 찾는 시간이 크게 줄어듭니다.
- 전사 백엔드를 다른 서비스로 교체할 수 있을 만큼 구조가 열려 있습니다.
- 출력물이 원본 폴더 옆에 모여서 작업 폴더가 지저분해지지 않습니다.
단점·확인할 점
- ffmpeg와 yt-dlp를 따로 설치해야 합니다.
- 기본 설정은 유료 음성 API 키를 요구합니다.
- 판단은 결국 사람이 해야 해서 제안을 그대로 쓰기보다 검토가 필요합니다.
INSTALL
설치 방법
- 01
git clone https://github.com/browser-use/video-use 로 원하는 위치에 내려받습니다.
- 02
저장소의 install.md 대로 의존성을 설치하고 스킬 디렉토리에 연결합니다.
- 03
촬영본이 든 폴더 경로를 알려주고 시작합니다.
설치 방법은 운영체제와 버전에 따라 달라질 수 있으니 공식 문서를 함께 확인하세요.
공식 자료