Get started
Edição de vídeo — Skill online

Edição de vídeo — Skill online

Video Editing, do projeto ECC de affaan-m. Transforme material bruto em vídeos prontos para publicar: planeje os cortes, apare e junte clipes, adicione sobreposições, legendas, música, narração e motion graphics, e reenquadre para YouTube, TikTok ou Instagram. Feito com FFmpeg, Remotion e ferramentas de IA opcionais para editar mais rápido sem substituir o material original.
#Vídeo#Produtividade#Mídia
Avaliação
São necessárias mais avaliações
Vendas
33
Como usar
Executar na Capafy
Também em aplicativos externos
Fornecido pelo publisher
GPT-5.6 Terra

Edição de vídeo

image.webp

Transforme material bruto em um vídeo finalizado e pronto para publicar: edição prática, legendas, narração, reenquadramento, melhorias visuais e exportação final.

Esta skill foi feita para editar vídeo de verdade, não apenas dar conselhos de edição. Envie suas gravações, imagens ou áudio e descreva o que quer mudar. Ela analisa o material, executa a edição e entrega o arquivo de vídeo pronto.

Observação: este agente edita apenas vídeos existentes. Ele não pode gerar um novo vídeo do zero.

O que ela faz

Editar e reestruturar o material

Organiza gravações brutas e transforma em um corte final mais enxuto.

Pode ajudar com:

  • Cortar trechos indesejados
  • Cortar e juntar clipes
  • Remover pausas desnecessárias
  • Reordenar segmentos
  • Ajustar a duração do vídeo
  • Criar edições de ritmo mais acelerado
  • Extrair os trechos úteis de gravações longas
  • Converter material em conteúdo de formato curto

A edição roda em ferramentas locais baseadas em FFmpeg, sem depender de serviço externo de edição.

Reenquadramento por plataforma

Adapta o material existente a diferentes formatos de publicação:

  • Vídeo vertical 9:16
  • Vídeo horizontal 16:9
  • Vídeo quadrado 1:1

A skill redimensiona, corta e reposiciona a imagem para TikTok, YouTube Shorts, Instagram Reels, YouTube e outros canais sociais.

Legendas

Quando há transcrição disponível, a skill converte a fala em legendas com marcação de tempo e usa esses timestamps durante a edição.

Ela pode criar:

  • Legendas padrão
  • Legendas para formato curto
  • Legendas grandes e fáceis de ler
  • Legendas de diálogo
  • Textos sobrepostos sincronizados

Em gravações longas, ela primeiro reduz a transcrição a um plano de edição com os timestamps necessários, em vez de processar o texto inteiro repetidas vezes.

Narração

A versão online inclui texto-para-voz local, então dá para gerar narrações simples em inglês sem conta na ElevenLabs nem API key.

A narração serve para:

  • Locução
  • Vídeos explicativos
  • Falas de abertura ou encerramento
  • Substituir faixas de voz
  • Vídeos feitos com imagens
  • Conteúdo curto para redes

O áudio gerado é mixado direto no vídeo final.

Sobreposições e movimento

Reforce o material existente com motion graphics leves e elementos visuais.

Exemplos:

  • Títulos
  • Textos sobrepostos
  • Cartelas de abertura e encerramento
  • Efeitos de zoom
  • Efeitos de pan
  • Sobreposição de imagens
  • Inserções visuais em tela cheia
  • Transições simples
  • Reenquadramentos e cortes animados

São efeitos pensados para melhorar o que você já gravou, sem exigir um pipeline completo de animação ou vídeo generativo.

Gera visuais de apoio quando faz sentido

Se o ambiente de execução oferecer geração de imagens, a skill pode criar alguns poucos visuais de apoio para a edição.

Útil quando falta uma cena específica no material original, por exemplo:

  • Ilustrações de B-roll
  • Fundos
  • Imagens conceituais
  • Gráficos de apoio
  • Explicações visuais
  • Inserts de cena
  • Arte de título ou transição

As imagens geradas entram direto no vídeo, preservando o áudio original por baixo.

A geração de imagens é intencionalmente limitada

Gerar imagens é um recurso de reforço, não a fonte principal do vídeo.

A skill segue estas regras:

  • Padrão: nenhuma imagem gerada
  • Edição normal: em geral 1 ou 2 visuais gerados
  • Máximo: 4 visuais gerados por edição
  • Reaproveitar material ou assets já gerados sempre que possível
  • Não gerar variações desnecessárias
  • Não regerar uma imagem a menos que a edição realmente exija

Assim a edição continua eficiente e o B-roll gerado por IA só aparece quando agrega valor real.

Transforme imagens em vídeo

Você também pode enviar imagens estáticas em vez de gravações.

A skill combina as imagens com:

  • Movimentos de pan e zoom
  • Narração
  • Legendas
  • Ritmo e tempos
  • Cortes
  • Áudio de fundo
  • Efeitos de movimento simples

Funciona bem para slideshows, explicativos, histórias narradas com fotos, visuais de produto e conteúdo de motion leve.

Processamento de áudio

Como parte da edição, a skill usa FFmpeg para processar e combinar áudio.

Dependendo do material, pode ajudar com:

  • Extração de áudio
  • Mixagem da narração
  • Ajuste de volume
  • Substituição de áudio
  • Combinar narração com o áudio original do vídeo
  • Adicionar a música ou os efeitos sonoros que você enviar

Como funciona

Um fluxo típico:

  1. Você envia o vídeo, as imagens ou o áudio de origem.
  2. Descreve o resultado que quer.
  3. A skill inspeciona o material disponível.
  4. Cria um plano de edição compacto com os timestamps e as operações necessárias.
  5. Reaproveita o material existente sempre que possível.
  6. Gera visuais de apoio só quando eles melhoram a edição.
  7. Aplica legendas, narração, sobreposições, cortes e as demais mudanças pedidas.
  8. O FFmpeg renderiza o vídeo final.
  9. Você recebe o MP4 pronto.

Exemplos de pedidos

Você pode pedir coisas como:

Transforme isso num TikTok de 30 segundos e coloque legendas grandes.

Tire as partes arrastadas e acelere o ritmo.

Converta esta gravação horizontal em um Short 9:16.

Adicione uma narração animada com este roteiro.

Coloque B-roll quando eu falo de agentes de IA.

Insira uma ilustração gerada de 00:18 a 00:23 mantendo minha voz original.

Adicione legendas e exporte o MP4 final.

Transforme estas imagens e esta narração em um vídeo vertical.

Faça uma abertura mais limpa, adicione legendas e normalize o áudio.

O que ela não faz

Esta skill é, antes de tudo, um editor de vídeo.

Ela não faz síntese generativa completa, como produzir uma animação 3D cinematográfica inteira a partir de um texto.

Um pedido como:

Crie do zero um desenho 3D animado de 60 segundos com personagens em movimento.

exige um modelo dedicado de texto para vídeo ou de animação.

Quando faz sentido, a skill pode usar imagens geradas, efeitos de movimento, narração, legendas e técnicas de edição para montar uma versão ilustrada ou de motion graphics mais simples — mas não vai apresentar isso como animação gerada de verdade.

Feita para uso online

O fluxo de edição evita dependências externas desnecessárias.

As funções centrais usam ferramentas embutidas ou locais:

  • FFmpeg
  • FFprobe
  • Texto-para-voz local
  • Utilitários de mídia em Python

Serviços externos como ElevenLabs, fal.ai, Descript, CapCut ou Replicate não são necessários para o fluxo de edição principal.

Se o ambiente de IA anfitrião oferecer geração de imagens, ela entra como reforço opcional, sem que o resto da edição dependa disso.

Ideal para

  • TikTok e Reels
  • YouTube Shorts
  • Vídeos do YouTube
  • Vídeos falando para a câmera
  • Tutoriais
  • Demonstrações de produto
  • Vídeos explicativos
  • Cortes de podcast e entrevistas
  • Conteúdo para redes sociais
  • Vídeos de imagens com narração
  • Material já gravado que precisa de um corte final mais limpo

Envie suas gravações e descreva o resultado que quer: o objetivo é devolver um vídeo pronto, não explicar como editá-lo.

Origem

Video Editing vem do projeto ECC de affaan-m.

Fonte:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing