시작하기
영상 편집 — 온라인 스킬

영상 편집 — 온라인 스킬

affaan-m의 ECC 프로젝트에서 가져온 Video Editing 스킬입니다. 컷 구성을 계획하고 클립을 잘라 붙이며 오버레이, 자막, 배경음악, 보이스오버, 모션 그래픽을 더하고 YouTube·TikTok·Instagram에 맞게 화면 비율을 다시 잡아, 촬영 원본을 바로 올릴 수 있는 영상으로 만들어 줍니다. FFmpeg와 Remotion, 선택적으로 쓰는 AI 도구를 기반으로 원본 영상을 대체하지 않고 편집 속도를 높입니다.
#비디오#생산성#미디어
평점
더 많은 평가가 필요합니다
판매
33
사용 방법
Capafy에서 실행
외부 앱에서도 사용 가능
퍼블리셔 제공
GPT-5.6 Terra

영상 편집

image.webp

촬영 원본을 바로 올릴 수 있는 완성 영상으로 만듭니다. 실질적인 편집, 자막, 보이스오버, 화면비 변환, 시각 요소 보강, 최종 내보내기까지 처리합니다.

이 스킬은 편집 조언만 주는 것이 아니라 실제로 영상을 편집하기 위해 만들어졌습니다. 영상, 이미지, 오디오를 업로드하고 어떻게 바꾸고 싶은지 설명하세요. 소재를 분석하고 편집을 실행해 완성된 영상 파일을 만들어 줍니다.

참고: 이 에이전트는 기존 영상만 편집할 수 있으며, 새로운 영상을 처음부터 생성할 수는 없습니다.

무엇을 하나요

영상 편집과 재구성

거친 원본 녹화를 군더더기 없는 최종본으로 정리합니다.

이런 작업이 가능합니다:

  • 불필요한 구간 잘라내기
  • 클립 컷 편집과 이어 붙이기
  • 늘어지는 공백 제거
  • 구간 순서 재배치
  • 영상 길이 조정
  • 템포가 빠른 편집
  • 긴 영상에서 쓸 만한 구간 추출
  • 기존 영상을 숏폼으로 변환

편집은 외부 편집 서비스 없이 FFmpeg 기반 로컬 도구로 처리됩니다.

플랫폼별 화면비 변환

기존 영상을 게시 형식에 맞게 변환합니다.

  • 9:16 세로 영상
  • 16:9 가로 영상
  • 1:1 정방형 영상

TikTok, YouTube Shorts, Instagram Reels, YouTube 등 채널에 맞춰 크기 조정, 크롭, 피사체 위치 조정을 할 수 있습니다.

자막 추가

전사(트랜스크립트)를 쓸 수 있으면 음성을 타임코드가 붙은 자막으로 바꾸고, 그 타임스탬프를 편집에도 활용합니다.

만들 수 있는 형태:

  • 일반 자막
  • 숏폼용 캡션
  • 크고 잘 읽히는 캡션
  • 대사 자막
  • 타이밍이 맞춰진 텍스트 오버레이

긴 녹음은 전체 스크립트를 반복해서 처리하지 않고, 먼저 편집 계획과 필요한 타임스탬프로 압축한 뒤 진행합니다.

보이스오버 추가

온라인 버전은 로컬 TTS를 지원해 ElevenLabs 계정이나 API 키 없이도 간단한 영어 내레이션을 만들 수 있습니다.

활용 예:

  • 내레이션
  • 설명 영상
  • 인트로·아웃트로 멘트
  • 음성 트랙 교체
  • 이미지 기반 영상
  • 짧은 소셜 콘텐츠

생성된 오디오는 최종 영상에 바로 믹싱됩니다.

오버레이와 모션 추가

가벼운 모션 그래픽과 시각 요소로 기존 영상을 보강합니다.

예:

  • 타이틀
  • 텍스트 오버레이
  • 인트로·아웃트로 카드
  • 줌 효과
  • 팬 효과
  • 이미지 오버레이
  • 전체 화면 삽입 비주얼
  • 간단한 트랜지션
  • 리프레이밍과 애니메이션 크롭

풀 애니메이션이나 생성형 영상 파이프라인 없이, 지금 있는 영상을 더 낫게 만드는 데 초점을 둔 효과입니다.

필요할 때만 보조 비주얼 생성

호스트 환경이 이미지 생성을 지원하면 편집에 쓸 보조 비주얼을 소량 만들 수 있습니다.

원본에 필요한 장면이 없을 때 특히 유용합니다.

  • B롤 일러스트
  • 배경 비주얼
  • 콘셉트 이미지
  • 보조 그래픽
  • 시각적 설명
  • 장면 삽입 컷
  • 타이틀·트랜지션 아트

생성한 이미지는 아래 깔린 원본 오디오를 유지한 채 영상에 바로 삽입됩니다.

이미지 생성은 의도적으로 최소화

이미지 생성은 영상의 주 소스가 아니라 보조 수단입니다.

스킬이 지키는 규칙:

  • 기본값: 생성 이미지 사용 안 함
  • 일반 편집: 보통 1~2장
  • 최대: 편집당 4장
  • 기존 영상이나 이미 만든 에셋을 최대한 재사용
  • 불필요한 변형은 만들지 않음
  • 편집상 꼭 필요하지 않으면 다시 생성하지 않음

덕분에 편집은 효율적으로 유지되고, 정말 가치가 있을 때만 AI 생성 B롤을 씁니다.

이미지를 영상으로

일반 촬영본 대신 정지 이미지만 제공해도 됩니다.

이미지에 다음을 결합할 수 있습니다:

  • 팬·줌 움직임
  • 보이스오버
  • 자막
  • 타이밍
  • 컷 전환
  • 배경 음악
  • 간단한 모션 효과

슬라이드쇼, 설명 영상, 내레이션이 들어간 이미지 스토리, 제품 비주얼, 가벼운 모션 영상에 적합합니다.

오디오 처리

편집의 일부로 FFmpeg을 사용해 오디오를 처리하고 합칩니다.

소재에 따라 가능한 작업:

  • 오디오 추출
  • 보이스오버 믹싱
  • 볼륨 조정
  • 오디오 교체
  • 원본 사운드와 내레이션 합치기
  • 제공한 음악이나 효과음 추가

작동 방식

일반적인 흐름:

  1. 원본 영상, 이미지, 오디오를 업로드합니다.
  2. 원하는 결과를 설명합니다.
  3. 스킬이 사용할 수 있는 소재를 확인합니다.
  4. 필요한 타임스탬프와 작업이 담긴 간결한 편집 계획을 만듭니다.
  5. 기존 영상을 최대한 재사용합니다.
  6. 결과가 더 좋아질 때만 보조 비주얼을 생성합니다.
  7. 자막, 보이스오버, 오버레이, 크롭 등 요청한 변경을 적용합니다.
  8. FFmpeg이 최종 영상을 렌더링합니다.
  9. 완성된 MP4를 돌려줍니다.

요청 예시

이렇게 말하면 됩니다.

이걸 30초 TikTok으로 만들고 큰 자막을 넣어줘.

늘어지는 부분은 빼고 템포를 더 빠르게 해줘.

이 가로 녹화본을 9:16 쇼츠로 바꿔줘.

이 스크립트로 밝은 톤의 보이스오버를 넣어줘.

AI 에이전트 얘기하는 부분에 B롤을 깔아줘.

00:18부터 00:23까지 생성 일러스트를 넣고 원래 목소리는 그대로 둬.

자막 넣고 완성본 MP4로 내보내줘.

이 이미지들과 내레이션으로 세로 영상 만들어줘.

인트로를 깔끔하게 다시 만들고, 자막 넣고, 음량을 정리해줘.

이 스킬이 하지 않는 것

이 스킬은 기본적으로 영상 편집 도구입니다.

텍스트 한 줄에서 극장용 3D 애니메이션을 통째로 만들어 내는 완전한 생성형 영상 합성은 하지 않습니다.

예를 들어 이런 요청:

캐릭터가 움직이는 60초짜리 풀 3D 애니메이션을 처음부터 만들어줘.

이런 작업에는 전용 text-to-video 또는 애니메이션 모델이 필요합니다.

상황에 따라 생성 이미지, 모션 효과, 내레이션, 자막, 편집 기법을 조합해 더 단순한 일러스트·모션 그래픽 버전을 만들 수는 있지만, 그것을 진짜 생성형 애니메이션인 것처럼 제시하지는 않습니다.

온라인 사용에 맞춘 설계

편집 워크플로는 불필요한 외부 의존을 피하도록 설계되었습니다.

핵심 기능은 내장 또는 로컬 도구를 사용합니다.

  • FFmpeg
  • FFprobe
  • 로컬 TTS
  • Python 기반 미디어 유틸리티

ElevenLabs, fal.ai, Descript, CapCut, Replicate 같은 외부 서비스는 핵심 편집 워크플로에 필요하지 않습니다.

호스트 AI 환경에서 이미지 생성을 쓸 수 있다면 선택적 보강 기능으로 활용하되, 나머지 편집 과정이 거기에 의존하지는 않습니다.

이런 경우에 좋습니다

  • TikTok과 Reels
  • YouTube Shorts
  • YouTube 영상
  • 말하는 사람 중심 영상
  • 튜토리얼
  • 제품 시연
  • 설명 영상
  • 팟캐스트·인터뷰 클립
  • 소셜 미디어 콘텐츠
  • 내레이션이 들어간 이미지 영상
  • 마무리 편집이 필요한 기존 영상

소재를 업로드하고 원하는 결과를 말해 주세요. 편집 방법을 설명하는 것이 아니라 완성된 영상을 돌려주는 것이 목표입니다.

출처

Video Editing은 affaan-m의 ECC 프로젝트에서 왔습니다.

소스:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing