開始使用
影片剪輯 — 線上技能

影片剪輯 — 線上技能

來自 affaan-m 的 ECC 專案的 Video Editing 技能。把原始素材剪成可直接發布的影片:規劃剪輯點、修剪與串接片段,加上疊加圖層、字幕、配樂、旁白與動態圖像,並依 YouTube、TikTok 或 Instagram 重新調整畫面比例。以 FFmpeg、Remotion 與選用的 AI 工具打造,剪得更快,且不會取代你的原始素材。
#影片#生產力#媒體
評分
需要更多評價
已售出
33
使用方式
在 Capafy 上執行
也可用於外部應用程式
由創作者提供
GPT-5.6 Terra

影片剪輯

image.webp

把原始素材變成可直接發布的成品影片:實用的剪輯、字幕、旁白、畫面比例調整、視覺強化,以及最終輸出。

這個技能是為了實際剪出影片而設計,不只是給你剪輯建議。上傳你的影片、圖片或音檔,並描述你想改成什麼樣子。技能會分析素材、執行剪輯,並產出完成的影片檔。

注意:這個 Agent 只能剪輯和處理現有影片,無法從零生成新影片。

功能說明

剪輯與重組素材

把原始錄影整理成節奏更緊湊的成片。

可以協助:

  • 修剪不要的片段
  • 切割與串接片段
  • 移除多餘的停頓
  • 重新排列段落
  • 調整影片長度
  • 做出節奏更快的剪法
  • 從長素材中擷取可用段落
  • 把素材改成短影音

剪輯由以 FFmpeg 為基礎的本機工具執行,不需要外部剪輯服務。

依平台重新調整畫面比例

把現有素材轉成不同的發布格式,包括:

  • 9:16 直式影片
  • 16:9 橫式影片
  • 1:1 方形影片

技能可以縮放、裁切並重新定位畫面,適用於 TikTok、YouTube Shorts、Instagram Reels、YouTube 等社群平台。

加上字幕

在有逐字稿的情況下,技能可以把語音轉成有時間軸的字幕,並在剪輯時使用這些時間點。

可以製作:

  • 一般字幕
  • 短影音風格字幕
  • 大字級易讀字幕
  • 對白字幕
  • 有時間軸的文字疊加

遇到長錄音時,會先把逐字稿濃縮成剪輯計畫與必要的時間點,而不是反覆處理整份逐字稿。

加上旁白

線上版內建本機語音合成(TTS),不需要 ElevenLabs 帳號或 API 金鑰,就能產生簡單的英文旁白。

旁白可用於:

  • 敘述
  • 說明型影片
  • 開場或結尾台詞
  • 替換原有的人聲軌
  • 圖片型影片
  • 短影音內容

產生的音檔可以直接混入最終影片。

加上視覺疊加與動態效果

用輕量的動態圖像與視覺元素強化現有畫面。

例如:

  • 標題
  • 文字疊加
  • 開場與結尾卡
  • 縮放效果
  • 平移效果
  • 圖片疊加
  • 全螢幕視覺插入
  • 簡單轉場
  • 重新構圖與動態裁切

這些效果的目的是強化既有素材,不需要完整的動畫或生成式影片流程。

必要時生成輔助視覺素材

若執行環境提供圖片生成功能,技能可以為這次剪輯產生少量輔助視覺素材。

當原始素材缺少某個畫面時特別好用,例如:

  • B-roll 示意圖
  • 背景視覺
  • 概念圖
  • 輔助圖形
  • 視覺化說明
  • 場景插入畫面
  • 標題或轉場美術

生成的圖片可以直接插入影片,同時保留底下的原始聲音。

圖片生成刻意保持克制

圖片生成是輔助工具,不是影片的主要來源。

技能遵循這些規則:

  • 預設:不使用生成圖片
  • 一般剪輯:通常 1~2 張生成素材
  • 上限:每次剪輯最多 4 張
  • 盡量重複使用既有素材或已生成的素材
  • 不產生不必要的變化版本
  • 除非剪輯真的需要,否則不重新生成圖片

這讓剪輯保持效率,同時只在真的有價值時才用 AI 生成的 B-roll。

把圖片變成影片

你也可以只提供靜態圖片,而不是傳統影片素材。

技能可以把圖片結合:

  • 平移與縮放運鏡
  • 旁白
  • 字幕
  • 時間節奏
  • 剪接點
  • 背景音樂
  • 簡單動態效果

很適合做投影片式影片、說明影片、有旁白的圖片故事、產品視覺,以及輕量的動態影片內容。

音訊處理

技能可以用 FFmpeg 處理與合併音訊,作為剪輯的一部分。

依素材而定,可以協助:

  • 抽出音訊
  • 旁白混音
  • 音量調整
  • 替換音訊
  • 把旁白與原影片聲音疊合
  • 加入你提供的音樂或音效

運作方式

典型流程如下:

  1. 上傳來源影片、圖片或音檔。
  2. 描述你想要的成果。
  3. 技能檢視可用的素材。
  4. 產出精簡的剪輯計畫,包含必要的時間點與操作。
  5. 盡可能沿用既有素材。
  6. 只有在能讓成片更好時,才生成輔助視覺素材。
  7. 套用字幕、旁白、疊加、裁切等你要求的調整。
  8. 由 FFmpeg 算圖輸出最終影片。
  9. 回傳完成的 MP4。

指令範例

你可以這樣說:

把這支剪成 30 秒的 TikTok,並加上大字字幕。

把節奏拖沓的地方刪掉,整體加快。

把這段橫式錄影轉成 9:16 的 Shorts。

用這份腳本加一段輕快的旁白。

我講到 AI agent 的時候加上 B-roll 畫面。

在 00:18 到 00:23 插入一張生成的插圖,並保留我原本的聲音。

加上字幕並輸出完成的 MP4。

把這些圖片和旁白做成直式影片。

做一個更乾淨的開場、加上字幕,並把音量標準化。

這個技能不做什麼

它本質上是影片剪輯工具。

它不做完整的生成式影片合成,例如從一段文字直接產出整部電影感的 3D 動畫。

例如這樣的需求:

從零做出一支 60 秒、角色會動的全動畫 3D 卡通。

這需要專門的文字轉影片或動畫模型。

在合適的情況下,這個技能可以改用生成的靜態視覺、動態效果、旁白、字幕與剪輯手法,做出比較簡單的插畫式或動態圖像版本——但不會把它當成真正的生成動畫。

為線上使用而設計

整個剪輯流程刻意避免不必要的外部相依。

核心功能使用內建或本機工具,例如:

  • FFmpeg
  • FFprobe
  • 本機語音合成(TTS)
  • Python 媒體處理工具

核心剪輯流程不需要 ElevenLabs、fal.ai、Descript、CapCut 或 Replicate 等外部服務。

如果執行環境提供圖片生成,可以當作選用的加強功能,而不會讓其餘剪輯流程依賴它。

最適合

  • TikTok 與 Reels
  • YouTube Shorts
  • YouTube 影片
  • 口播為主的影片
  • 教學影片
  • 產品示範
  • 說明型影片
  • Podcast 與訪談片段
  • 社群內容
  • 有旁白的圖片影片
  • 需要收尾剪乾淨的既有素材

上傳素材並描述你要的成果——目標是交回一支完成的影片,而不只是告訴你怎麼剪。

來源

Video Editing 來自 affaan-m 的 ECC 專案。

原始碼:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing