Empezar
Edición de video — Skill online

Edición de video — Skill online

Video Editing, del proyecto ECC de affaan-m. Convierte material en bruto en videos listos para publicar: planifica los cortes, recorta y une clips, agrega superposiciones, subtítulos, música, voz en off y motion graphics, y reencuadra para YouTube, TikTok o Instagram. Construido sobre FFmpeg, Remotion y herramientas de IA opcionales para editar más rápido sin reemplazar el material original.
#Vídeo#Productividad#Medios
Valoración
Se necesitan más valoraciones
Vendidos
33
Cómo se usa
Ejecutar en Capafy
También en aplicaciones externas
Proporcionado por el publisher
GPT-5.6 Terra

Edición de video

image.webp

Convierte material en bruto en un video terminado y listo para publicar: edición práctica, subtítulos, voz en off, reencuadre, mejoras visuales y exportación final.

Esta skill está hecha para editar video de verdad, no solo para darte consejos de edición. Sube tu material, imágenes o audio y describe qué quieres cambiar. La skill analiza el material, ejecuta la edición y entrega el archivo de video terminado.

Nota: Este agente edita videos existentes. No puede generar un video nuevo desde cero.

Qué hace

Editar y reestructurar el material

Ordena grabaciones en bruto y las convierte en un corte final más ajustado.

Puede ayudarte con:

  • Recortar secciones que sobran
  • Cortar y unir clips
  • Eliminar pausas innecesarias
  • Reordenar segmentos
  • Cambiar la duración del video
  • Lograr un ritmo más ágil
  • Extraer las partes útiles de grabaciones largas
  • Convertir material en contenido de formato corto

La edición se realiza con herramientas locales basadas en FFmpeg, sin depender de un servicio de edición externo.

Reencuadre para cada plataforma

Adapta el material existente a distintos formatos de publicación:

  • Video vertical 9:16
  • Video horizontal 16:9
  • Video cuadrado 1:1

La skill puede redimensionar, recortar y reposicionar la imagen para TikTok, YouTube Shorts, Instagram Reels, YouTube y otros canales sociales.

Subtítulos y captions

Cuando hay transcripción disponible, la skill convierte el audio hablado en subtítulos con tiempos y usa esas marcas durante la edición.

Puede crear:

  • Subtítulos estándar
  • Captions para formato corto
  • Captions grandes y fáciles de leer
  • Subtítulos de diálogo
  • Textos superpuestos sincronizados

En grabaciones largas, primero reduce la transcripción a un plan de edición con las marcas de tiempo necesarias, en lugar de procesar el texto completo una y otra vez.

Voz en off

La versión online incluye texto a voz local, así que puedes generar narraciones sencillas en inglés sin cuenta de ElevenLabs ni API key.

La voz en off sirve para:

  • Narración
  • Videos explicativos
  • Frases de intro o cierre
  • Reemplazar pistas de voz
  • Videos hechos con imágenes
  • Contenido corto para redes

El audio generado se mezcla directamente en el video final.

Superposiciones y movimiento

Refuerza el material existente con motion graphics ligeros y elementos visuales.

Por ejemplo:

  • Títulos
  • Textos superpuestos
  • Tarjetas de intro y cierre
  • Efectos de zoom
  • Efectos de paneo
  • Superposición de imágenes
  • Inserciones visuales a pantalla completa
  • Transiciones simples
  • Reencuadres y recortes animados

Son efectos pensados para mejorar el material que ya tienes, sin necesidad de un pipeline completo de animación o video generativo.

Genera visuales de apoyo cuando aportan

Si el entorno donde corre la skill ofrece generación de imágenes, puede crear unos pocos visuales de apoyo para la edición.

Resulta útil cuando al material original le falta una toma concreta, por ejemplo:

  • Ilustraciones de B-roll
  • Fondos
  • Imágenes conceptuales
  • Gráficos de apoyo
  • Explicaciones visuales
  • Insertos de escena
  • Arte para títulos o transiciones

Las imágenes generadas se insertan directamente en el video conservando el audio original por debajo.

La generación de imágenes es deliberadamente limitada

Generar imágenes es una mejora, no la fuente principal del video.

La skill sigue estas reglas:

  • Por defecto: sin imágenes generadas
  • Edición normal: 1 o 2 visuales generados
  • Máximo: 4 visuales generados por edición
  • Reutilizar material o assets ya generados siempre que se pueda
  • No generar variaciones innecesarias
  • No regenerar una imagen salvo que la edición realmente lo pida

Así la edición sigue siendo eficiente y el B-roll generado con IA solo aparece cuando aporta valor real.

Convierte imágenes en video

También puedes entregar imágenes fijas en lugar de material grabado.

La skill puede combinarlas con:

  • Movimientos de paneo y zoom
  • Voz en off
  • Subtítulos
  • Ritmo y tiempos
  • Cortes
  • Audio de fondo
  • Efectos de movimiento simples

Funciona bien para presentaciones, explicativos, historias narradas con fotos, visuales de producto y contenido de motion ligero.

Procesamiento de audio

Como parte de la edición, la skill usa FFmpeg para procesar y combinar audio.

Según el material de origen, puede ayudarte con:

  • Extracción de audio
  • Mezcla de la voz en off
  • Ajuste de volumen
  • Reemplazo de audio
  • Combinar narración con el audio original del video
  • Añadir la música o los efectos de sonido que aportes

Cómo funciona

Un flujo típico:

  1. Subes el video, las imágenes o el audio de origen.
  2. Describes el resultado que quieres.
  3. La skill revisa el material disponible.
  4. Crea un plan de edición compacto con las marcas de tiempo y operaciones necesarias.
  5. Reutiliza el material existente siempre que puede.
  6. Genera visuales de apoyo solo cuando mejoran la edición.
  7. Aplica subtítulos, voz en off, superposiciones, recortes y demás cambios pedidos.
  8. FFmpeg renderiza el video final.
  9. Recibes el MP4 terminado.

Ejemplos de pedidos

Puedes pedir cosas así:

Conviértelo en un TikTok de 30 segundos y ponle subtítulos grandes.

Quita las partes lentas y dale más ritmo.

Pasa esta grabación horizontal a un Short 9:16.

Agrega una voz en off animada con este guion.

Pon B-roll cuando hablo de agentes de IA.

Inserta una ilustración generada de 00:18 a 00:23 y deja mi voz original.

Agrega subtítulos y exporta el MP4 final.

Convierte estas imágenes y esta narración en un video vertical.

Haz una intro más limpia, agrega subtítulos y normaliza el audio.

Qué no hace

Esta skill es, ante todo, un editor de video.

No hace síntesis generativa completa, como producir una animación 3D cinematográfica entera a partir de un texto.

Por ejemplo, un pedido como:

Crea desde cero un dibujo animado 3D de 60 segundos con personajes en movimiento.

necesita un modelo dedicado de texto a video o de animación.

Cuando tiene sentido, la skill puede usar imágenes generadas, efectos de movimiento, narración, subtítulos y técnicas de edición para armar una versión ilustrada o de motion graphics más simple, pero nunca la presentará como animación generada real.

Pensada para uso online

El flujo de edición evita dependencias externas innecesarias.

Las funciones centrales usan herramientas incluidas o locales:

  • FFmpeg
  • FFprobe
  • Texto a voz local
  • Utilidades de medios en Python

Servicios externos como ElevenLabs, fal.ai, Descript, CapCut o Replicate no hacen falta para el flujo de edición central.

Si el entorno de IA anfitrión ofrece generación de imágenes, se usa como mejora opcional sin que el resto del flujo dependa de ella.

Ideal para

  • TikTok y Reels
  • YouTube Shorts
  • Videos de YouTube
  • Videos a cámara (talking head)
  • Tutoriales
  • Demos de producto
  • Videos explicativos
  • Clips de podcasts y entrevistas
  • Contenido para redes sociales
  • Videos de imágenes con narración
  • Material existente que necesita un corte final más limpio

Sube tu material y describe el resultado que buscas: el objetivo es devolverte un video terminado, no explicarte cómo editarlo.

Origen

Video Editing proviene del proyecto ECC de affaan-m.

Fuente:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing