はじめる
動画編集 — オンラインスキル

動画編集 — オンラインスキル

affaan-m の ECC プロジェクト発の Video Editing スキル。カット構成を設計し、クリップのトリミングと連結、オーバーレイ・字幕・BGM・ナレーション・モーショングラフィックスの追加、YouTube/TikTok/Instagram 向けの画角変更までを行い、撮ったままの素材を公開できる動画に仕上げます。FFmpeg と Remotion、任意で使える AI ツールをベースに、元素材を置き換えることなく編集を高速化します。
#動画#生産性#メディア
評価
さらに評価が必要です
販売数
33
利用方法
Capafy で実行
外部アプリでも利用可能
パブリッシャー提供
GPT-5.6 Terra

動画編集

image.webp

撮ったままの素材を、そのまま公開できる完成動画に。実用的な編集、字幕、ナレーション、画角変更、ビジュアルの強化、最終書き出しまで対応します。

このスキルは実際に動画を編集するためのものです。編集のアドバイスを返すだけではありません。映像・画像・音声をアップロードし、どう変えたいかを伝えてください。素材を解析し、編集を実行し、完成した動画ファイルを出力します。

注意:このエージェントは既存の動画を編集するためのものです。ゼロから新しい動画を生成することはできません。

できること

素材の編集・再構成

撮ったままの録画を整理し、締まった一本にまとめます。

対応できる作業:

  • 不要な部分のトリミング
  • クリップのカットと連結
  • 不要な間の削除
  • 構成の並べ替え
  • 尺の調整
  • テンポの速い編集
  • 長尺素材から使える部分の抜き出し
  • 素材のショート動画化

編集は FFmpeg ベースのローカルツールで実行され、外部の編集サービスは不要です。

プラットフォーム別の画角変更

既存の素材を各配信フォーマットに変換します。

  • 9:16 縦型動画
  • 16:9 横型動画
  • 1:1 正方形動画

TikTok、YouTube Shorts、Instagram Reels、YouTube などに合わせて、リサイズ・クロップ・被写体位置の調整ができます。

字幕・キャプションの追加

文字起こしが利用できる場合、音声をタイムコード付きの字幕に変換し、そのタイムスタンプを編集にも活用します。

作成できるもの:

  • 通常の字幕
  • ショート向けキャプション
  • 大きく読みやすいキャプション
  • セリフ字幕
  • タイミング付きテキストオーバーレイ

長時間の録音では、全文を何度も処理せず、まず編集プランと必要なタイムスタンプに要約してから進めます。

ナレーションの追加

オンライン版はローカル音声合成(TTS)に対応しているため、ElevenLabs のアカウントや API キーなしで簡単な英語ナレーションを生成できます。

ナレーションの用途:

  • 語り
  • 解説動画
  • 冒頭・締めのひとこと
  • 音声トラックの差し替え
  • 画像ベースの動画
  • ショート向けコンテンツ

生成した音声は、そのまま最終動画にミックスできます。

オーバーレイとモーションの追加

軽量なモーショングラフィックスとビジュアル要素で、既存の映像を強化します。

例:

  • タイトル
  • テキストオーバーレイ
  • オープニング/エンディングカード
  • ズーム効果
  • パン効果
  • 画像オーバーレイ
  • 全画面のビジュアルインサート
  • シンプルなトランジション
  • リフレーミングとアニメーションクロップ

本格的なアニメーション制作や生成動画のパイプラインを使わずに、いまある映像を良くするための効果です。

必要なときだけ補助ビジュアルを生成

実行環境が画像生成に対応している場合、編集用の補助ビジュアルを少量だけ作成できます。

元素材に必要なカットがないときに役立ちます。

  • B-roll のイラスト
  • 背景ビジュアル
  • コンセプト画像
  • 補助グラフィック
  • 図解
  • シーンのインサート
  • タイトル・トランジション用アート

生成した画像は、下の元音声を保ったまま動画に直接差し込めます。

画像生成はあえて控えめ

画像生成は補助的な手段であり、動画の主役ではありません。

スキルが従うルール:

  • 既定:生成画像は使わない
  • 通常の編集:1〜2 枚程度
  • 上限:1 回の編集につき 4 枚まで
  • 既存素材や生成済みアセットを優先して再利用
  • 不要なバリエーションは作らない
  • 編集上どうしても必要でない限り作り直さない

効率を保ちながら、本当に価値があるときだけ AI 生成の B-roll を使えます。

画像から動画をつくる

通常の映像ではなく、静止画だけを渡すこともできます。

画像に次の要素を組み合わせられます:

  • パン・ズームの動き
  • ナレーション
  • 字幕
  • タイミング
  • カット割り
  • BGM
  • シンプルなモーション効果

スライドショー、解説動画、ナレーション付きの写真ストーリー、商品ビジュアル、軽めのモーション動画に向いています。

音声処理

編集の一部として、FFmpeg で音声を処理・合成できます。

素材に応じて対応できる作業:

  • 音声の抽出
  • ナレーションのミックス
  • 音量調整
  • 音声の差し替え
  • 元の音声とナレーションの重ね合わせ
  • 提供された音楽・効果音の追加

使い方の流れ

典型的なワークフロー:

  1. 元の動画・画像・音声をアップロードする。
  2. どんな仕上がりにしたいかを伝える。
  3. スキルが使える素材を確認する。
  4. 必要なタイムスタンプと処理をまとめた編集プランを作成する。
  5. 既存の素材をできるだけ再利用する。
  6. 仕上がりが良くなる場合だけ補助ビジュアルを生成する。
  7. 字幕、ナレーション、オーバーレイ、クロップなど、指定された変更を適用する。
  8. FFmpeg が最終動画をレンダリングする。
  9. 完成した MP4 を返す。

依頼の例

こんな伝え方ができます。

これを 30 秒の TikTok にして、大きめの字幕を付けて。

間延びしているところを削って、テンポを上げて。

この横向きの録画を 9:16 のショートにして。

このスクリプトで明るいトーンのナレーションを付けて。

AI エージェントの話をしているところに B-roll を入れて。

00:18〜00:23 に生成イラストを差し込んで、声はそのままで。

字幕を付けて MP4 で書き出して。

この画像とナレーションで縦型動画にして。

冒頭をすっきりさせて、字幕を付けて、音量を整えて。

対応していないこと

これはあくまで動画編集のスキルです。

テキストから映画のような 3D アニメーションを丸ごと作るような、完全な生成動画の合成は行いません。

たとえば次のような依頼:

キャラクターが動く 60 秒のフル 3D アニメをゼロから作って。

これには専用の text-to-video またはアニメーション向けモデルが必要です。

必要に応じて、生成した静止画・モーション効果・ナレーション・字幕・編集技法を使って、イラストやモーショングラフィックス寄りの簡易版を作ることはできますが、それを本物の生成アニメーションとして提示することはありません。

オンライン利用を前提に設計

編集ワークフローは、不要な外部依存を避けるように作られています。

中核機能は、同梱またはローカルのツールを使用します。

  • FFmpeg
  • FFprobe
  • ローカル音声合成(TTS)
  • Python 製のメディアユーティリティ

ElevenLabs、fal.ai、Descript、CapCut、Replicate などの外部サービスは、中核の編集ワークフローには不要です。

ホスト側の AI 環境で画像生成が使える場合は任意の追加機能として利用できますが、他の編集処理がそれに依存することはありません。

こんな用途に

  • TikTok・Reels
  • YouTube Shorts
  • YouTube 動画
  • 話し手中心の動画
  • チュートリアル
  • 製品デモ
  • 解説動画
  • ポッドキャストやインタビューの切り抜き
  • SNS 向けコンテンツ
  • ナレーション付きの画像動画
  • 仕上げの編集が必要な既存素材

素材をアップロードして、欲しい結果を伝えてください。編集方法を説明するのではなく、完成した動画を返すことが目的です。

ソース

Video Editing は affaan-m の ECC プロジェクト由来です。

ソース:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing