
Montage vidéo — Skill en ligne
Montage vidéo
Transformez vos rushs en une vidéo soignée et prête à être publiée grâce au montage, aux sous-titres, à la voix off, au recadrage, aux améliorations visuelles et à l'export final.
Ce skill est conçu pour monter de vrais contenus vidéo existants, et pas seulement pour donner des conseils de montage. Importez vos vidéos, images ou fichiers audio et décrivez les modifications souhaitées. Le skill peut analyser les médias, effectuer le montage et produire le fichier vidéo final.
Remarque : cet agent monte des séquences vidéo existantes. Il ne peut pas générer une nouvelle vidéo complète à partir de zéro.
Ce qu'il peut faire
Monter et restructurer des séquences
Nettoyez vos rushs et transformez-les en un montage final plus court, plus fluide et plus efficace.
Il peut notamment :
- Supprimer les passages indésirables
- Couper et assembler des clips
- Retirer les pauses inutiles
- Réorganiser les séquences
- Modifier la durée d'une vidéo
- Accélérer le rythme du montage
- Extraire les passages utiles d'un enregistrement long
- Transformer une vidéo longue en contenu court
Le montage est réalisé avec des outils locaux basés sur FFmpeg, sans nécessiter de service de montage externe.
Adapter le format aux différentes plateformes
Convertissez vos séquences existantes dans différents formats de publication, notamment :
- Vidéo verticale 9:16
- Vidéo horizontale 16:9
- Vidéo carrée 1:1
Le skill peut redimensionner, recadrer et repositionner les séquences pour TikTok, YouTube Shorts, Instagram Reels, YouTube et d'autres plateformes sociales.
Ajouter des sous-titres et des captions
Lorsqu'une transcription est disponible, le skill peut convertir les paroles en sous-titres synchronisés et utiliser directement leurs horodatages pendant le montage.
Il peut créer :
- Des sous-titres classiques
- Des captions pour les formats courts sur les réseaux sociaux
- De grandes captions faciles à lire
- Des sous-titres de dialogue
- Des textes synchronisés à l'écran
Pour les enregistrements longs, le skill réduit d'abord la transcription aux passages, horodatages et instructions utiles au montage, au lieu de retraiter constamment l'intégralité du texte.
Ajouter une voix off
La version en ligne intègre une fonction locale de synthèse vocale. Elle peut donc générer une narration simple en anglais sans compte ElevenLabs ni clé API.
La voix off peut être utilisée pour :
- La narration
- Les vidéos explicatives
- Les phrases d'introduction ou de conclusion
- Le remplacement d'une piste vocale
- Les vidéos créées à partir d'images
- Les contenus courts pour les réseaux sociaux
L'audio généré peut ensuite être mixé directement dans la vidéo finale.
Ajouter des éléments visuels et du mouvement
Améliorez vos séquences existantes avec des animations légères et des éléments graphiques.
Par exemple :
- Titres
- Textes en surimpression
- Cartons d'introduction et de conclusion
- Effets de zoom
- Effets de panoramique
- Images en surimpression
- Inserts visuels en plein écran
- Transitions simples
- Recadrages et mouvements de cadre animés
Ces effets sont conçus pour enrichir des séquences existantes sans nécessiter une chaîne complète d'animation ou de génération vidéo.
Générer des visuels d'appoint si nécessaire
Si l'environnement hôte prend en charge la génération d'images, le skill peut créer un petit nombre de visuels supplémentaires pour compléter le montage.
Ces images peuvent être utiles lorsqu'il manque un plan pertinent dans les séquences originales, par exemple pour :
- Des illustrations de B-roll
- Des visuels d'arrière-plan
- Des images conceptuelles
- Des éléments graphiques complémentaires
- Des explications visuelles
- Des inserts de scène
- Des illustrations pour les titres ou les transitions
Les images générées peuvent être intégrées directement à la vidéo tout en conservant l'audio original en arrière-plan.
La génération d'images est volontairement limitée
La génération d'images est un outil complémentaire, et non la source principale de la vidéo.
Le skill suit les règles suivantes :
- Par défaut : aucune image générée
- Pour un montage classique : généralement 1 à 2 visuels générés
- Maximum : 4 visuels générés par montage
- Réutiliser autant que possible les séquences ou éléments déjà disponibles
- Ne pas créer de variantes inutiles
- Ne pas régénérer une image sauf si le montage l'exige réellement
Cela permet de conserver un processus efficace tout en utilisant du B-roll généré par IA lorsqu'il apporte une réelle valeur ajoutée.
Transformer des images en vidéo
Vous pouvez également fournir des images fixes à la place de séquences vidéo classiques.
Le skill peut les combiner avec :
- Des mouvements panoramiques et des zooms
- Une voix off
- Des sous-titres
- Une gestion précise du timing
- Des coupes
- Un fond sonore
- Des effets de mouvement simples
Cette fonction convient particulièrement aux diaporamas, vidéos explicatives, histoires illustrées avec narration, visuels de produits et contenus vidéo animés légers.
Traitement audio
Le skill peut utiliser FFmpeg pour traiter et combiner les pistes audio pendant le montage.
Selon les fichiers fournis, il peut notamment :
- Extraire l'audio
- Mixer une voix off
- Ajuster le volume
- Remplacer une piste audio
- Combiner une narration avec l'audio original de la vidéo
- Ajouter de la musique ou des effets sonores fournis
Comment ça marche
Un workflow classique ressemble à ceci :
- Importez la vidéo, les images ou l'audio source.
- Décrivez le résultat souhaité.
- Le skill analyse les médias disponibles.
- Il crée un plan de montage synthétique avec les horodatages et opérations nécessaires.
- Les séquences existantes sont réutilisées autant que possible.
- Des visuels complémentaires ne sont générés que s'ils améliorent réellement le montage.
- Les sous-titres, voix off, surimpressions, recadrages et autres modifications demandées sont appliqués.
- FFmpeg effectue le rendu de la vidéo finale.
- Le fichier MP4 terminé est renvoyé.
Exemples de demandes
Transforme cette vidéo en TikTok de 30 secondes et ajoute de grandes captions.
Supprime les passages trop lents et rends le montage plus dynamique.
Convertis cet enregistrement horizontal en Short vertical 9:16.
Ajoute une voix off dynamique à partir de ce script.
Ajoute du B-roll visuel lorsque je parle d'agents IA.
Insère une illustration générée de 00:18 à 00:23 tout en conservant ma voix originale.
Ajoute des sous-titres et exporte le MP4 final.
Transforme ces images et cette narration en vidéo verticale.
Crée une intro plus propre, ajoute des captions et normalise le son.
Ce que ce skill ne fait pas
Ce skill est avant tout un outil de montage vidéo.
Il ne réalise pas de génération vidéo complète, par exemple la création d'une animation 3D cinématographique entière à partir d'un simple prompt textuel.
Une demande comme :
Crée de zéro un dessin animé 3D entièrement animé de 60 secondes avec des personnages en mouvement.
nécessite un modèle dédié de génération text-to-video ou d'animation.
Lorsque cela convient, ce skill peut toutefois utiliser des images fixes générées, des effets de mouvement, une narration, des sous-titres et des techniques de montage pour créer une version illustrée ou en motion design plus simple. Il ne la présentera cependant pas comme une véritable animation générée.
Conçu pour une utilisation en ligne
Le workflow de montage est conçu pour éviter les dépendances externes inutiles.
Les fonctions principales utilisent des outils intégrés ou locaux tels que :
- FFmpeg
- FFprobe
- Synthèse vocale locale
- Outils multimédias basés sur Python
Les services externes comme ElevenLabs, fal.ai, Descript, CapCut ou Replicate ne sont pas nécessaires au fonctionnement principal du montage.
Si l'environnement IA hôte propose la génération d'images, celle-ci peut être utilisée comme amélioration facultative sans rendre le reste du workflow dépendant de cette fonction.
Idéal pour
- TikTok et Reels
- YouTube Shorts
- Vidéos YouTube
- Vidéos face caméra
- Tutoriels
- Démonstrations de produits
- Vidéos explicatives
- Extraits de podcasts et d'interviews
- Contenus pour les réseaux sociaux
- Vidéos narrées à partir d'images
- Séquences existantes nécessitant un montage final plus propre
Importez vos médias et décrivez le résultat souhaité : l'objectif est de vous fournir une vidéo terminée, et pas simplement de vous expliquer comment la monter.
Source
Video Editing est issu du projet ECC d'affaan-m.
Source :
https://github.com/affaan-m/ECC/tree/main/skills/video-editing


