video-use:用 AI Agent 自動剪片的開源 Skill
如果你想用 AI 自動剪片,video-use 可以讓 Claude Code 等 AI 工具讀取資料夾裡的原始素材,依照你的剪輯要求完成轉錄,刪除部分停頓與贅詞,加入字幕,轉場和畫面元素,最後輸出 edit/final.mp4。
它比較像一個可反覆修改的 AI rough-cut 工作流,不是按下按鈕就一定能交件的成片機器。
AI 自動剪片 Skill 適合哪一類影片
video-use 最容易理解的使用情境是 talking-head,教學與口播影片。這些素材的剪輯判斷通常高度依賴講話內容與停頓位置,適合先透過 transcript 找出要保留或刪除的區段。
如果影片主要靠快速動作,音樂節奏或大量無聲畫面傳達內容,單靠 transcript 與抽取的視覺摘要就可能不夠。
它可以做什麼
- 從一個資料夾讀取原始影片素材
- 轉錄語音內容
- 移除部分填充詞與無聲區段
- 進行基本調色與淡入淡出
- 燒錄字幕
- 加入圖片或其他視覺 overlay
- 回看輸出並接受第二輪自然語言修改
這個多輪修改能力很重要。自動剪輯第一次通常只能產出可以觀看的初稿,真正的價值是你能指出「這句不要剪掉」「這裡字幕太快」「這張圖晚兩秒出現」,再讓 Agent 修改。
安裝需要什麼
上游流程需要 ffmpeg,也使用 Python 工具管理與執行 scripts。若要下載線上素材,可另外安裝 yt-dlp。
目前最需要注意的是 ElevenLabs API key。官方 README 將 ElevenLabs Scribe 用於轉錄,因此這不是完全零設定,也不是完全本機流程。音訊會交給第三方服務處理,可能涉及費用,隱私與供應商限制。
官方的手動安裝範例偏向 macOS,包含 Homebrew 與 symlink。Windows 使用者不能直接假設步驟完全相同,應先在測試資料夾確認 PATH,ffmpeg 與 Python 環境。
建議的第一次測試
- 先選一段一到三分鐘的非敏感口播影片。
- 只要求去除明顯停頓並加上字幕。
- 檢查 transcript 是否正確,尤其是人名與專有名詞。
- 對照原始影片,確認沒有刪掉改變語意的停頓。
- 再加入調色,overlay 與更複雜的剪輯要求。
不要一開始就用一小時訪談或唯一一份正式素材。先確認流程能穩定產生 final.mp4,再逐步增加長度與複雜度。
它不是真的完整看完影片
video-use 會透過 transcript 與選取的影格或 visual composite 理解素材。這能降低模型讀取長影片的成本,但也表示快速出現的畫面,沒有語音的事件與細微表情可能被漏掉。
因此,最後仍需要人回看整支影片。尤其是自動刪除填充詞時,語句節奏與情緒可能被剪得太緊。
來源與授權
- 官方 repository:https://github.com/browser-use/video-use
- GitHub Releases:https://github.com/browser-use/video-use/releases
- 作者組織:
browser-use - License:MIT
- Release 狀態:研究時未找到正式 release 或 tag
- Commit 快照:
92c2b34e44c2 - 研究快照:2026-08-09
官方 GitHub 目前沒有提供 Release 套件,安裝與更新以 repository 的 install.md,SKILL.md 與 README 為準。