video-use:用 AI Agent 自動剪片的開源 Skill

如果你想用 AI 自動剪片,video-use 可以讓 Claude Code 等 AI 工具讀取資料夾裡的原始素材,依照你的剪輯要求完成轉錄,刪除部分停頓與贅詞,加入字幕,轉場和畫面元素,最後輸出 edit/final.mp4

它比較像一個可反覆修改的 AI rough-cut 工作流,不是按下按鈕就一定能交件的成片機器。

AI 自動剪片 Skill 適合哪一類影片

video-use 最容易理解的使用情境是 talking-head,教學與口播影片。這些素材的剪輯判斷通常高度依賴講話內容與停頓位置,適合先透過 transcript 找出要保留或刪除的區段。

如果影片主要靠快速動作,音樂節奏或大量無聲畫面傳達內容,單靠 transcript 與抽取的視覺摘要就可能不夠。

它可以做什麼

這個多輪修改能力很重要。自動剪輯第一次通常只能產出可以觀看的初稿,真正的價值是你能指出「這句不要剪掉」「這裡字幕太快」「這張圖晚兩秒出現」,再讓 Agent 修改。

安裝需要什麼

上游流程需要 ffmpeg,也使用 Python 工具管理與執行 scripts。若要下載線上素材,可另外安裝 yt-dlp。

目前最需要注意的是 ElevenLabs API key。官方 README 將 ElevenLabs Scribe 用於轉錄,因此這不是完全零設定,也不是完全本機流程。音訊會交給第三方服務處理,可能涉及費用,隱私與供應商限制。

官方的手動安裝範例偏向 macOS,包含 Homebrew 與 symlink。Windows 使用者不能直接假設步驟完全相同,應先在測試資料夾確認 PATH,ffmpeg 與 Python 環境。

建議的第一次測試

  1. 先選一段一到三分鐘的非敏感口播影片。
  2. 只要求去除明顯停頓並加上字幕。
  3. 檢查 transcript 是否正確,尤其是人名與專有名詞。
  4. 對照原始影片,確認沒有刪掉改變語意的停頓。
  5. 再加入調色,overlay 與更複雜的剪輯要求。

不要一開始就用一小時訪談或唯一一份正式素材。先確認流程能穩定產生 final.mp4,再逐步增加長度與複雜度。

它不是真的完整看完影片

video-use 會透過 transcript 與選取的影格或 visual composite 理解素材。這能降低模型讀取長影片的成本,但也表示快速出現的畫面,沒有語音的事件與細微表情可能被漏掉。

因此,最後仍需要人回看整支影片。尤其是自動刪除填充詞時,語句節奏與情緒可能被剪得太緊。

來源與授權

官方 GitHub 目前沒有提供 Release 套件,安裝與更新以 repository 的 install.mdSKILL.md 與 README 為準。