Aan de slag
YouTube-transcript: Lange video's snel begrijpen

YouTube-transcript: Lange video's snel begrijpen

YouTube-transcriptietool voor studenten die colleges in notities omzetten, podcastluisteraars die een citaat zoeken en iedereen die klaar is met lange video’s doorspoelen. Plak een openbare link naar een tutorial, lezing, podcast, college of interview en ontvang vaak binnen twee minuten een woordelijk transcript met AI-samenvatting en kernpunten. Exporteer als platte tekst, Markdown met tijdstempels of SRT. Het transcript blijft in de brontaal; de samenvatting wordt vertaald naar je chattaal.
#Video#Sociale media
Beoordeling
4.0
Verkocht
33
Gebruikswijze
Uitvoeren op Capafy
Ook in externe apps
Publisher levert
Claude Sonnet 4.6

YouTube-transcript — Plak een video, krijg de woorden

ytb.webp

Plak een YouTube-link — een gewone video, Short, Live-herhaling, podcast, college of volledige cursus — en ontvang een woordelijk transcript in de gesproken taal, een samenvatting in jouw taal en een downloadbaar bestand. Geen instellingenmenu, geen compromis met de oorspronkelijke taal en geen handmatig kopiëren van ieder fragment uit het transcriptvenster van YouTube.

Deze Skill zet gesproken YouTube-content om in tekst die je kunt doorzoeken, citeren en vertalen. Ze werkt met elke openbare YouTube-video in elke taal, ondersteunt platte tekst, Markdown met tijdstempels en SRT-ondertitels, en selecteert het formaat automatisch op basis van hoe je je verzoek formuleert, niet via een instellingenpagina.

Voor wie deze Skill bedoeld is

  • Onderzoekers en analisten die lange interviews, podcasts en conferenties omzetten in doorzoekbare tekst: lees in 5 minuten wat 90 minuten kijken zou kosten
  • Studenten en andere leerlingen die colleges, tutorials en educatieve series gebruiken voor aantekeningen, herhaling en studiegidsen
  • Journalisten en factcheckers die citeren uit YouTube-video’s, openbare verklaringen, interviews en politieke toespraken
  • Contentmakers die lange video’s hergebruiken als Shorts, Reels, TikToks, blogs, nieuwsbrieven of podcasts
  • Podcasters die afleveringen omzetten in doorzoekbare shownotes, artikelen en SEO-content
  • Marketeers en concurrentieonderzoekers die kanalen, merkvideo’s, verkoopwebinars en productdemo’s analyseren
  • Ingenieurs, ontwikkelaars en technische leerlingen die conferenties, tutorials en code-reviews als doorzoekbare tekst willen bewaren
  • Taalleerders die moedertaalcontent gebruiken met een woordelijk transcript en vertaalde samenvatting
  • Vertalers en lokalisatieteams die brontekst voorbereiden voor ondertiteling, nasynchronisatie en internationale versies
  • Toegankelijkheidsteams en docenten die SRT-bestanden maken wanneer automatische YouTube-ondertiteling onvoldoende nauwkeurig is
  • Predikanten, coaches en docenten die preken, lezingen en cursussen archiveren en hergebruiken
  • Kenniswerkers en managers die lange vakinhoudelijke presentaties en earnings calls liever doorzoeken dan volledig afspelen

Welk probleem het oplost

YouTube bevat het grootste archief van gesproken kennis ter wereld: interviews, podcasts, colleges, conferenties, cursussen, nieuws, preken, trainingen en deskundige analyses. Het platform biedt automatische ondertiteling en een transcriptvenster, maar bruikbare tekst verkrijgen blijft onnodig lastig:

  • Het transcriptvenster deelt tekst niet logisch in en exporteert niet schoon: kopiëren levert een muur van fragmenten met tijdstempels op
  • Automatische ondertiteling is onbetrouwbaar bij accenten, vaktermen, eigennamen en overlappende stemmen
  • Een ingebouwde samenvatting ontbreekt, zelfs bij video’s van 90 minuten
  • Een eenvoudige SRT-export voor hergebruik of vertaling ontbreekt
  • Zoeken over meerdere video’s is niet mogelijk, omdat ieder transcript apart blijft

Externe tools falen vaak op een van deze drie manieren:

  • Ze vertalen het transcript terwijl dat niet de bedoeling is. Je wilde een Spaanstalige gast woordelijk citeren, maar kreeg een Engelse parafrase.
  • Ze laten de samenvatting in de brontaal staan. Je leest geen Duits, maar de samenvatting verschijnt in het Duits.
  • Ze verbergen alles achter een instellingenmenu. Je wilde alleen een link plakken, maar moet API-sleutels, uitvoerpaden en opties instellen.

Het gedeelde probleem is dat deze tools zijn geoptimaliseerd voor ontwikkelaars die workflows bouwen, niet voor onderzoekers, journalisten, studenten of creators die binnen 30 seconden een resultaat willen.

Deze Skill neemt een link en een zin. Ze levert het juiste resultaat.

Wat deze Skill anders maakt

1. Standaard uitvoer in twee talen.

Het transcript blijft woordelijk in de oorspronkelijke audiotaal. Elk citaat blijft woord voor woord precies zoals het is uitgesproken. De samenvatting en kernpunten verschijnen in je gesprekstaal. Een Engelstalige gebruiker die een Spaans interview transcribeert, ontvangt een Spaans transcript en een Engelse samenvatting. Een Mandarijnsprekende gebruiker die een Japans college verwerkt, ontvangt een Japans transcript en een samenvatting in het Mandarijn. Geen schakelaar en geen taalparameter. Tweetalige uitvoer is de standaard, omdat de toepassing precies dat nodig heeft: een exact citaat in de ene taal en snel begrip in een andere.

2. Het uitvoerformaat komt uit je formulering, niet uit een menu.

Schrijf ‘geef me ondertitels’ → je ontvangt een SRT-bestand voor Premiere, DaVinci Resolve, CapCut of YouTube Studio. Schrijf ‘met tijdstempels zodat ik het gedeelte over prijzen kan vinden’ → je ontvangt Markdown met [MM:SS] aan het begin van iedere alinea, citeerbaar tot op de seconde. Noem geen formaat → je ontvangt schone platte tekst, eenvoudig te lezen, samen te vatten en in Notion, Google Docs of Obsidian te plakken. De herkenning van trefwoorden werkt in het Engels, Spaans, Chinees, Japans en Koreaans. ‘字幕’, ‘タイムスタンプ’ en ‘자막’ activeren dezelfde uitvoer als hun Engelse tegenhangers.

3. Snel bij lange content, zelfs een podcast van drie uur.

Lange podcasts, conferenties van twee uur, volledige colleges, AMA’s en earnings calls zijn de content waarvoor transcriptie het meeste waarde biedt en waarbij traditionele tools het langzaamst worden. Veel AI-tools sturen eerst het volledige transcript naar het samenvattingsmodel, waardoor lange video’s 60–120 seconden extra kosten en content van meerdere uren enkele minuten langer duurt. Deze Skill maakt een compacte samenvattingsversie met de eerste en laatste zin van iedere alinea. Dat gebruikt ongeveer de helft van de invoertokens met een vergelijkbare samenvattingskwaliteit. De ervaring verandert van ‘vijf minuten wachten op een tekstmuur’ in ‘binnen twee minuten een duidelijke samenvatting en opgeslagen bestand’. Het volledige transcript wordt nog steeds opgeslagen.

Ondersteunde YouTube-content

Contenttype Ondersteund Opmerkingen
Gewone video’s ✓ Het meest voorkomende geval. De meeste worden in 30–90 seconden getranscribeerd.
YouTube Shorts ✓ Korte video’s onder 60 seconden. Zelfde verwerking als TikTok en Reels.
Live-herhalingen ✓ Lives die na afloop op het kanaal zijn opgeslagen.
Podcasts en volledige afleveringen ✓ Het meest voorkomende gebruik voor lange content.
Afgelopen YouTube-premières ✓ Na afloop verwerkt als gewone video’s.
Colleges en volledige cursussen ✓ Universiteitscolleges, online cursussen en trainingen.
Video’s voor leden ✗ De link moet zonder login of lidmaatschap toegankelijk zijn.
Actieve Live-uitzendingen ✗ Alleen afgeronde opnamen werken.
Leeftijdsgebonden video’s ✗ Wanneer leeftijdsverificatie nodig is, levert de link geen resultaat.
Regionaal geblokkeerde video’s ✗ Wanneer de video niet beschikbaar is in de verwerkingsregio, mislukt de transcriptie.
Verwijderde of privévideo’s ✗ De video kan verwijderd, privé of verborgen zijn.

Voorbeelden

Voorbeeld 1 — Onderzoek doen met een podcast van twee uur

Een onderzoeker schrijft een rapport en wil de belangrijkste argumenten uit een podcast met een vakexpert halen.

‘Wat zei de gast over verstoringen in de toeleveringsketen? https://youtu.be/abc123def’

Wat terugkomt:

  • Eerst het gedeelte over de toeleveringsketen met woordelijke citaten en context
  • Een samenvatting van 2–4 zinnen
  • 3–6 kernpunten
  • Het volledige transcript als downloadbaar bestand

Voorbeeld 2 — Een lange YouTube-video omzetten in een blogartikel

Een creator heeft een analyse van 45 minuten gepubliceerd en wil daar een blog, nieuwsbrief en reeks clips van maken.

‘Transcribeer deze video met tijdstempels https://youtu.be/myvideo123’

Wat terugkomt:

  • Een samenvatting van 2–4 zinnen over de argumentatie
  • 3–6 kernpunten als artikelstructuur
  • Het volledige transcript in Markdown met [MM:SS] per alinea

Voorbeeld 3 — Een conferentie ondertitelen voor hergebruik

Een technisch team wil een oudere conferentie met SRT-ondertitels op een intern leerplatform plaatsen.

‘Maak SRT-ondertitels voor https://www.youtube.com/watch?v=xyz789’

Wat terugkomt:

  • Een .srt-bestand in standaard SubRip-formaat met correcte tijdcodes
  • Een korte samenvatting en kernpunten voor beschrijving en metadata

Uitvoerformaten

Formaat Geactiveerd door Gebruik
Platte tekst (.txt) Standaard, geen formaatwoord nodig Lezen, samenvatten, citeren of plakken in Notion, Google Docs, Obsidian, artikelen en nieuwsbrieven
Markdown met tijdstempels (.md) ‘tijdstempels’, ‘tijdcodes’, ‘met tijden’, ‘时间戳’, ‘タイムスタンプ’ Exacte momenten vinden, clips selecteren, studienotities of citeerbare referenties maken
SRT-ondertitels (.srt) ‘ondertitels’, ‘captions’, ‘SRT’, ‘字幕’, ‘サブタイトル’, ‘자막’ Opnieuw publiceren met ondertiteling, toegankelijkheid verbeteren, vertaling of nasynchronisatie voorbereiden

Taalondersteuning

De transcriptie-engine ondersteunt Engels, Spaans, Portugees, Frans, Duits, Italiaans, Nederlands, Mandarijn, Kantonees, Japans, Koreaans, Vietnamees, Thais, Indonesisch, Tagalog, Arabisch, Hindi, Urdu, Russisch, Turks, Pools, Tsjechisch, Hongaars en de meeste belangrijke Europese, Aziatische, Midden-Oosterse en Latijns-Amerikaanse talen. Bij meertalige video’s wordt de dominante taal als basis gebruikt, terwijl het woordelijke transcript alle gesproken talen behoudt.

Je hoeft de taal niet op te geven. Signalen in de URL en kanaalnaam sturen de automatische detectie. Wanneer de eerste poging leeg is, probeert de Skill het één keer opnieuw in je gesprekstaal. Na twee lege pogingen wordt om bevestiging gevraagd. Meestal is de video privé, leeftijdsgebonden, regionaal geblokkeerd, alleen voor leden of verwijderd.

Wanneer je de audiotaal al kent, kun je die in je verzoek noemen, zoals ‘deze Spaanstalige podcast’ of ‘de audio is in het Japans’.

Nauwkeurigheid en verwachtingen

Het transcript is woordelijk. Het wordt door een spraakherkenningssysteem geproduceerd en nooit herschreven of geparafraseerd. Stopwoorden, herhalingen, aarzelingen en overlappende gesprekken blijven behouden. Dat is belangrijk wanneer de exacte formulering als bewijs dient in journalistiek, onderzoek, juridische situaties of factchecking.

De nauwkeurigheid is hoog bij duidelijke audio van één spreker. De meeste podcasts, colleges en goed geproduceerde video’s worden met weinig fouten getranscribeerd. Gesprekken met meerdere sprekers, overlappende stemmen, zeer technische termen, zeldzame eigennamen, sterke accenten, oude opnamen op afstand en sterk gecomprimeerde audio kunnen de nauwkeurigheid verminderen. Controleer belangrijke citaten altijd in de oorspronkelijke video.

De Skill verwerkt alleen openbare videolinks. Ze logt niet in op YouTube en heeft geen toegang tot privécontent, content voor leden of verborgen video’s.

Buiten bereik

  • Lokale videobestanden — .mp4-downloads, schermopnamen en opgeslagen bestanden moeten worden verwerkt met de bijbehorende audio-to-text-Skill
  • Actieve Live-uitzendingen — alleen afgeronde opnamen werken
  • Video’s voor leden of met leeftijdsbeperking — de link moet zonder login of verificatie toegankelijk zijn
  • Privé- en verborgen video’s — de Skill kan niet namens jou op YouTube inloggen
  • Muziekvideo’s zonder gesproken inhoud — instrumentale tracks en uitvoeringen zonder gesproken tekst bevatten niets nuttigs om te transcriberen
  • Vertaling van het transcript zelf — het transcript blijft bewust in de brontaal; vraag na ontvangst om een vertaling