Loslegen
Videoschnitt — Online-Skill

Videoschnitt — Online-Skill

Video Editing aus dem ECC-Projekt von affaan-m. Damit wird aus Rohmaterial ein fertiges Video: Schnittplanung, Clips kürzen und zusammensetzen, Einblendungen, Untertitel, Musik, Voiceover und Motion Graphics ergänzen sowie das Bildformat für YouTube, TikTok oder Instagram anpassen. Basiert auf FFmpeg, Remotion und optionalen KI-Tools: schneller schneiden, ohne das Originalmaterial zu ersetzen.
#Video#Produktivität#Medien
Rating
Weitere Bewertungen erforderlich
Sold
33
How to use
Auf Capafy ausführen
Auch in externen Apps
Vom Herausgeber bereitgestellt
GPT-5.6 Terra

Videobearbeitung

image.webp

Verwandle Rohmaterial durch praktische Videobearbeitung, Untertitel, Voiceover, Anpassung des Bildformats, visuelle Verbesserungen und finalen Export in ein professionelles, veröffentlichungsfertiges Video.

Dieser Skill ist für die Bearbeitung echter, vorhandener Videoinhalte gedacht – nicht nur dafür, Tipps zum Videoschnitt zu geben. Lade dein Video-, Bild- oder Audiomaterial hoch und beschreibe, was geändert werden soll. Der Skill kann das Material analysieren, die Bearbeitung durchführen und die fertige Videodatei ausgeben.

Hinweis: Dieser Agent bearbeitet vorhandenes Videomaterial. Er kann kein komplett neues Video von Grund auf erzeugen.

Was der Skill kann

Videomaterial schneiden und neu strukturieren

Bereinige Rohaufnahmen und verwandle sie in einen kompakteren, stimmigen Final Cut.

Zum Beispiel:

  • Unerwünschte Abschnitte entfernen
  • Clips schneiden und zusammenfügen
  • Unnötige Pausen entfernen
  • Szenen neu anordnen
  • Videolänge anpassen
  • Das Schnitttempo erhöhen
  • Relevante Passagen aus langen Aufnahmen extrahieren
  • Lange Videos in Kurzform-Content umwandeln

Die Bearbeitung erfolgt mit lokalen, FFmpeg-basierten Tools und benötigt keinen externen Videoschnittdienst.

Für verschiedene Plattformen neu formatieren

Vorhandenes Videomaterial kann für unterschiedliche Veröffentlichungsformate angepasst werden, darunter:

  • 9:16 Hochformat
  • 16:9 Querformat
  • 1:1 Quadratformat

Der Skill kann Videos skalieren, zuschneiden und neu positionieren – etwa für TikTok, YouTube Shorts, Instagram Reels, YouTube und andere Social-Media-Plattformen.

Untertitel und Captions hinzufügen

Wenn eine Transkription verfügbar ist, kann der Skill gesprochene Inhalte in zeitlich abgestimmte Untertitel umwandeln und diese Zeitstempel direkt für den Schnitt verwenden.

Möglich sind unter anderem:

  • Klassische Untertitel
  • Social-Media-Captions für Kurzvideos
  • Große, gut lesbare Captions
  • Dialoguntertitel
  • Zeitgesteuerte Texteinblendungen

Bei langen Aufnahmen reduziert der Skill das Transkript zunächst auf die relevanten Schnittanweisungen und Zeitstempel, anstatt das gesamte Transkript immer wieder zu verarbeiten.

Voiceover hinzufügen

Die Online-Version unterstützt lokale Text-to-Speech-Ausgabe. Dadurch lassen sich einfache englische Voiceovers erstellen, ohne ein ElevenLabs-Konto oder einen API-Key zu benötigen.

Voiceovers eignen sich zum Beispiel für:

  • Sprechertexte
  • Erklärvideos
  • Intro- oder Outro-Sätze
  • Ersatz für vorhandene Tonspuren
  • Videos auf Basis von Bildern
  • Kurze Social-Media-Videos

Das erzeugte Audio kann anschließend direkt in das fertige Video gemischt werden.

Visuelle Overlays und Bewegung hinzufügen

Erweitere vorhandenes Videomaterial mit einfachen Motion-Graphics und visuellen Elementen.

Zum Beispiel:

  • Titel
  • Texteinblendungen
  • Intro- und Outro-Karten
  • Zoom-Effekte
  • Schwenk-Effekte
  • Bild-Overlays
  • Vollflächige visuelle Einblendungen
  • Einfache Übergänge
  • Neurahmung und animierte Ausschnitte

Diese Effekte sollen vorhandenes Material aufwerten, ohne eine vollständige Animations- oder generative Video-Pipeline zu erfordern.

Bei Bedarf unterstützende Bilder erzeugen

Wenn die Host-Umgebung Bildgenerierung unterstützt, kann der Skill eine begrenzte Anzahl zusätzlicher visueller Elemente für den Schnitt erzeugen.

Generierte Bilder können sinnvoll sein, wenn im Originalmaterial eine passende Aufnahme fehlt, zum Beispiel für:

  • B-Roll-Illustrationen
  • Hintergrundbilder
  • Konzeptbilder
  • Ergänzende Grafiken
  • Visuelle Erklärungen
  • Szeneneinblendungen
  • Grafiken für Titel oder Übergänge

Die erzeugten Bilder können direkt in das Video eingefügt werden, während der Originalton darunter erhalten bleibt.

Bildgenerierung wird bewusst begrenzt eingesetzt

Bildgenerierung ist ein Werkzeug zur Ergänzung, nicht die primäre Quelle des Videos.

Der Skill folgt dabei diesen Regeln:

  • Standardmäßig werden keine Bilder generiert
  • Bei normalen Bearbeitungen meist 1–2 generierte Bilder
  • Maximal 4 generierte Bilder pro Bearbeitung
  • Vorhandenes Material oder bereits erzeugte Assets werden nach Möglichkeit wiederverwendet
  • Keine unnötigen Varianten erzeugen
  • Bilder nur neu generieren, wenn es für den Schnitt wirklich erforderlich ist

So bleibt die Bearbeitung effizient, während KI-generiertes B-Roll dort eingesetzt werden kann, wo es einen echten Mehrwert bietet.

Bilder in ein Video verwandeln

Du kannst auch Standbilder anstelle von klassischem Videomaterial bereitstellen.

Der Skill kann Bilder kombinieren mit:

  • Schwenk- und Zoombewegungen
  • Voiceover
  • Untertiteln
  • Zeitlicher Abstimmung
  • Schnitten
  • Hintergrundton
  • Einfachen Bewegungseffekten

Das eignet sich besonders für Slideshows, Erklärvideos, vertonte Bildergeschichten, Produktvisualisierungen und einfache Motion-Videos.

Audiobearbeitung

Der Skill kann FFmpeg verwenden, um Audio als Teil des Videoschnitts zu bearbeiten und zu kombinieren.

Abhängig vom Ausgangsmaterial sind unter anderem möglich:

  • Audio extrahieren
  • Voiceover einmischen
  • Lautstärke anpassen
  • Tonspur ersetzen
  • Sprechertext mit vorhandenem Videoton kombinieren
  • Bereitgestellte Musik oder Soundeffekte hinzufügen

So funktioniert es

Ein typischer Ablauf sieht so aus:

  1. Lade das Ausgangsvideo, Bilder oder Audio hoch.
  2. Beschreibe das gewünschte Ergebnis.
  3. Der Skill analysiert die verfügbaren Mediendateien.
  4. Er erstellt einen kompakten Schnittplan mit den benötigten Zeitstempeln und Bearbeitungsschritten.
  5. Vorhandenes Videomaterial wird nach Möglichkeit wiederverwendet.
  6. Zusätzliche Bilder werden nur dann generiert, wenn sie den Schnitt tatsächlich verbessern.
  7. Untertitel, Voiceover, Overlays, Zuschnitte und andere gewünschte Änderungen werden angewendet.
  8. FFmpeg rendert das fertige Video.
  9. Die fertige MP4-Datei wird ausgegeben.

Beispielanfragen

Mach daraus ein 30-sekündiges TikTok-Video und füge große Captions hinzu.

Entferne die langsamen Stellen und mach den Schnitt dynamischer.

Wandle diese Querformat-Aufnahme in ein 9:16-Short um.

Füge mit diesem Skript ein fröhliches Voiceover hinzu.

Füge visuelles B-Roll ein, wenn ich über KI-Agenten spreche.

Füge von 00:18 bis 00:23 eine generierte Illustration ein und behalte dabei meine Originalstimme bei.

Füge Untertitel hinzu und exportiere die fertige MP4-Datei.

Verwandle diese Bilder und den Sprechertext in ein vertikales Video.

Erstelle ein saubereres Intro, füge Captions hinzu und normalisiere den Ton.

Was dieser Skill nicht ist

Dieser Skill ist in erster Linie ein Videoeditor.

Er führt keine vollständige generative Videosynthese durch und kann beispielsweise nicht allein aus einem Text-Prompt eine komplette filmische 3D-Animation erzeugen.

Eine Anfrage wie:

Erstelle von Grund auf einen vollständig animierten 60-sekündigen 3D-Cartoon mit bewegten Figuren.

erfordert ein spezielles Text-to-Video- oder Animationsmodell.

Wenn es sinnvoll ist, kann dieser Skill stattdessen generierte Standbilder, Bewegungseffekte, Sprechertext, Untertitel und Schnitttechniken verwenden, um eine einfachere illustrierte oder Motion-Graphics-Version zu erstellen. Diese wird jedoch nicht als vollständig KI-generierte Animation ausgegeben.

Für die Online-Nutzung entwickelt

Der Bearbeitungs-Workflow ist darauf ausgelegt, unnötige externe Abhängigkeiten zu vermeiden.

Die Kernfunktionen nutzen integrierte oder lokale Tools wie:

  • FFmpeg
  • FFprobe
  • Lokale Text-to-Speech-Funktion
  • Python-basierte Medienwerkzeuge

Externe Dienste wie ElevenLabs, fal.ai, Descript, CapCut oder Replicate werden für den grundlegenden Bearbeitungs-Workflow nicht benötigt.

Wenn in der Host-KI-Umgebung Bildgenerierung verfügbar ist, kann sie optional zur visuellen Ergänzung genutzt werden, ohne dass der restliche Workflow davon abhängig ist.

Besonders geeignet für

  • TikTok und Reels
  • YouTube Shorts
  • YouTube-Videos
  • Talking-Head-Videos
  • Tutorials
  • Produktdemos
  • Erklärvideos
  • Podcasts und Interview-Clips
  • Social-Media-Content
  • Vertonte Bildervideos
  • Vorhandenes Videomaterial, das einen saubereren Final Cut benötigt

Lade dein Material hoch und beschreibe das gewünschte Ergebnis – das Ziel ist ein fertiges Video und nicht nur eine Anleitung, wie du es selbst schneiden kannst.

Quelle

Video Editing stammt aus dem ECC-Projekt von affaan-m.

Quelle:
https://github.com/affaan-m/ECC/tree/main/skills/video-editing