
Edición de video — Skill online
Edición de video
Convierte material en bruto en un video terminado y listo para publicar: edición práctica, subtítulos, voz en off, reencuadre, mejoras visuales y exportación final.
Esta skill está hecha para editar video de verdad, no solo para darte consejos de edición. Sube tu material, imágenes o audio y describe qué quieres cambiar. La skill analiza el material, ejecuta la edición y entrega el archivo de video terminado.
Nota: Este agente edita videos existentes. No puede generar un video nuevo desde cero.
Qué hace
Editar y reestructurar el material
Ordena grabaciones en bruto y las convierte en un corte final más ajustado.
Puede ayudarte con:
- Recortar secciones que sobran
- Cortar y unir clips
- Eliminar pausas innecesarias
- Reordenar segmentos
- Cambiar la duración del video
- Lograr un ritmo más ágil
- Extraer las partes útiles de grabaciones largas
- Convertir material en contenido de formato corto
La edición se realiza con herramientas locales basadas en FFmpeg, sin depender de un servicio de edición externo.
Reencuadre para cada plataforma
Adapta el material existente a distintos formatos de publicación:
- Video vertical 9:16
- Video horizontal 16:9
- Video cuadrado 1:1
La skill puede redimensionar, recortar y reposicionar la imagen para TikTok, YouTube Shorts, Instagram Reels, YouTube y otros canales sociales.
Subtítulos y captions
Cuando hay transcripción disponible, la skill convierte el audio hablado en subtítulos con tiempos y usa esas marcas durante la edición.
Puede crear:
- Subtítulos estándar
- Captions para formato corto
- Captions grandes y fáciles de leer
- Subtítulos de diálogo
- Textos superpuestos sincronizados
En grabaciones largas, primero reduce la transcripción a un plan de edición con las marcas de tiempo necesarias, en lugar de procesar el texto completo una y otra vez.
Voz en off
La versión online incluye texto a voz local, así que puedes generar narraciones sencillas en inglés sin cuenta de ElevenLabs ni API key.
La voz en off sirve para:
- Narración
- Videos explicativos
- Frases de intro o cierre
- Reemplazar pistas de voz
- Videos hechos con imágenes
- Contenido corto para redes
El audio generado se mezcla directamente en el video final.
Superposiciones y movimiento
Refuerza el material existente con motion graphics ligeros y elementos visuales.
Por ejemplo:
- Títulos
- Textos superpuestos
- Tarjetas de intro y cierre
- Efectos de zoom
- Efectos de paneo
- Superposición de imágenes
- Inserciones visuales a pantalla completa
- Transiciones simples
- Reencuadres y recortes animados
Son efectos pensados para mejorar el material que ya tienes, sin necesidad de un pipeline completo de animación o video generativo.
Genera visuales de apoyo cuando aportan
Si el entorno donde corre la skill ofrece generación de imágenes, puede crear unos pocos visuales de apoyo para la edición.
Resulta útil cuando al material original le falta una toma concreta, por ejemplo:
- Ilustraciones de B-roll
- Fondos
- Imágenes conceptuales
- Gráficos de apoyo
- Explicaciones visuales
- Insertos de escena
- Arte para títulos o transiciones
Las imágenes generadas se insertan directamente en el video conservando el audio original por debajo.
La generación de imágenes es deliberadamente limitada
Generar imágenes es una mejora, no la fuente principal del video.
La skill sigue estas reglas:
- Por defecto: sin imágenes generadas
- Edición normal: 1 o 2 visuales generados
- Máximo: 4 visuales generados por edición
- Reutilizar material o assets ya generados siempre que se pueda
- No generar variaciones innecesarias
- No regenerar una imagen salvo que la edición realmente lo pida
Así la edición sigue siendo eficiente y el B-roll generado con IA solo aparece cuando aporta valor real.
Convierte imágenes en video
También puedes entregar imágenes fijas en lugar de material grabado.
La skill puede combinarlas con:
- Movimientos de paneo y zoom
- Voz en off
- Subtítulos
- Ritmo y tiempos
- Cortes
- Audio de fondo
- Efectos de movimiento simples
Funciona bien para presentaciones, explicativos, historias narradas con fotos, visuales de producto y contenido de motion ligero.
Procesamiento de audio
Como parte de la edición, la skill usa FFmpeg para procesar y combinar audio.
Según el material de origen, puede ayudarte con:
- Extracción de audio
- Mezcla de la voz en off
- Ajuste de volumen
- Reemplazo de audio
- Combinar narración con el audio original del video
- Añadir la música o los efectos de sonido que aportes
Cómo funciona
Un flujo típico:
- Subes el video, las imágenes o el audio de origen.
- Describes el resultado que quieres.
- La skill revisa el material disponible.
- Crea un plan de edición compacto con las marcas de tiempo y operaciones necesarias.
- Reutiliza el material existente siempre que puede.
- Genera visuales de apoyo solo cuando mejoran la edición.
- Aplica subtítulos, voz en off, superposiciones, recortes y demás cambios pedidos.
- FFmpeg renderiza el video final.
- Recibes el MP4 terminado.
Ejemplos de pedidos
Puedes pedir cosas así:
Conviértelo en un TikTok de 30 segundos y ponle subtítulos grandes.
Quita las partes lentas y dale más ritmo.
Pasa esta grabación horizontal a un Short 9:16.
Agrega una voz en off animada con este guion.
Pon B-roll cuando hablo de agentes de IA.
Inserta una ilustración generada de 00:18 a 00:23 y deja mi voz original.
Agrega subtítulos y exporta el MP4 final.
Convierte estas imágenes y esta narración en un video vertical.
Haz una intro más limpia, agrega subtítulos y normaliza el audio.
Qué no hace
Esta skill es, ante todo, un editor de video.
No hace síntesis generativa completa, como producir una animación 3D cinematográfica entera a partir de un texto.
Por ejemplo, un pedido como:
Crea desde cero un dibujo animado 3D de 60 segundos con personajes en movimiento.
necesita un modelo dedicado de texto a video o de animación.
Cuando tiene sentido, la skill puede usar imágenes generadas, efectos de movimiento, narración, subtítulos y técnicas de edición para armar una versión ilustrada o de motion graphics más simple, pero nunca la presentará como animación generada real.
Pensada para uso online
El flujo de edición evita dependencias externas innecesarias.
Las funciones centrales usan herramientas incluidas o locales:
- FFmpeg
- FFprobe
- Texto a voz local
- Utilidades de medios en Python
Servicios externos como ElevenLabs, fal.ai, Descript, CapCut o Replicate no hacen falta para el flujo de edición central.
Si el entorno de IA anfitrión ofrece generación de imágenes, se usa como mejora opcional sin que el resto del flujo dependa de ella.
Ideal para
- TikTok y Reels
- YouTube Shorts
- Videos de YouTube
- Videos a cámara (talking head)
- Tutoriales
- Demos de producto
- Videos explicativos
- Clips de podcasts y entrevistas
- Contenido para redes sociales
- Videos de imágenes con narración
- Material existente que necesita un corte final más limpio
Sube tu material y describe el resultado que buscas: el objetivo es devolverte un video terminado, no explicarte cómo editarlo.
Origen
Video Editing proviene del proyecto ECC de affaan-m.
Fuente:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing


