Introductie van BillionVerify: verifieer miljarden e-mails tegen 1% van de kosten. Probeer BillionVerify

transcript.im
← Blog

YouTube transcript generator: video naar tekst vertalen

Door LeoYouTube

Met een YouTube transcript generator zet je een video om naar tekst: eerst worden de gesproken regels gegenereerd, daarna vertaald met behoud van tijdstempels.

YouTube transcript generator: video naar tekst vertalen

Om een YouTube-video naar tekst te vertalen, schrijf je op wat er gezegd wordt en vertaal je die regels. Het beeld is niet wat vertaald wordt. De gesproken woorden zijn dat wel. YouTube kan ondertitels tonen terwijl een video speelt, en bij sommige video's kan de speler een vertaalde ondertitel over het beeld tekenen zolang je kijkt. Die overlay verdwijnt zodra je weggaat. Een vertaling die je kunt citeren, doorzoeken of aan iemand anders kunt geven, is een transcript dat vertaald is, waarbij elke regel nog steeds naar het oorspronkelijke moment wijst.

YouTube's help-pagina over het bekijken van transcripts beschrijft de leesweergave: open Show transcript in de beschrijving, volg de huidige regel, klik op een regel om ernaartoe te springen. Er wordt geen vertaald document beschreven, en ook niet hoe je er een opslaat. De rest van deze pagina is de volgorde die het document oplevert. Genereer het transcript. Vertaal de regels. Laat de tijden waar ze stonden.

Waarom een transcript vertalen

De reden om het transcript te vertalen in plaats van het videobestand, is dat de woorden zijn wat je opnieuw zult gebruiken. Een lezing die je beter in tekst dan op gehoor volgt, een bewering die je in de taal van je notities wilt citeren, en een fragment dat je voor een ander publiek van ondertitels wilt voorzien, beginnen allemaal bij hetzelfde object: de gesproken regels, in tekst. Het vertalen van de MP4 levert die tekst niet op. Het nasynchroniseren van een nieuwe stemtrack doet dat evenmin. Dat zijn andere klussen, en deze pagina gaat daar niet over.

Een paar kijkers hebben alleen de overlay nodig. Als de speler al een vertaling toont en je kijkt maar één keer, blijf daar dan. Laat het los wanneer je de formulering nodig hebt nadat het tabblad is gesloten, wanneer je op een zin wilt zoeken, of wanneer de vertaling naar een document of editor moet. De overlay is een weergave. Het transcript is de tekst.

Het transcript trekt ook een harde grens rond wat vertaald kan worden. Spraak valt binnen het bereik. Ingebrande titelkaarten, lower thirds en andere tekst die in het beeld is verwerkt, worden niet gelezen en dus niet vertaald. Een muziekvideo met weinig of geen spraak komt er mager uit, omdat er weinig spraak is om op te schrijven. Twee mensen die door elkaar praten, een lawaaierige ruimte en een gedempte microfoon verzwakken de bronregels, en een vertaling kan een regel die al fout was niet repareren. Lees de bron naast de tijdcode voordat je de vertaling als citaat behandelt.

De link moet openbaar zijn. Een privévideo, een verwijderde video, een video die alleen voor leden is, of een link die alleen in iemands eigen account speelt, gaat niet open via een geplakte openbare URL. Leeftijdsgrenzen en regiobeperkingen kunnen hetzelfde verzoek tegenhouden. Er is geen schakelaar die een video afdwingt die YouTube niet wil leveren.

Eerst genereren, dan vertalen

Vertalen is de tweede stap. De eerste stap is het transcript, in de taal van de ondertitels of van de spraak. Sla die stap over en er is niets in regelvorm om te vertalen. Een samenvatting, een reactiedraad of de videobeschrijving is geen vervanging. Ze zijn niet de gesproken volgorde en ze hebben geen tijd per regel.

Vier stappen om een YouTube-video naar tekst te vertalen: kopieer de URL, genereer de regels, vertaal en controleer en exporteer

Op transcript.im doe je het in deze volgorde:

  1. Kopieer de URL van de openbare video die je in een andere taal wilt.
  2. Plak hem en genereer de regels voordat je een doeltaal kiest. Ondertitels die al bij de video staan, zijn de bron. Spraak wordt alleen getranscribeerd als die ondertitels ontbreken.
  3. Voer Translate uit op die regels en kies één ondersteunde taal. De formulering verandert. De upload op YouTube niet.
  4. Controleer de vertaalde regel tegen de oorspronkelijke tijd. Exporteer wanneer de vertaling buiten de browser moet bestaan.

Om een YouTube-transcript te vertalen gebruik je de YouTube transcript generator; de link heb je al. Je uploadt de video niet opnieuw, en je typt de vertaling niet met de hand in, tenzij je achteraf een regel corrigeert. Een correctie blijft in jouw kopie staan. Ze wordt niet teruggeschreven naar de oorspronkelijke upload.

De doeltaal is een van de ondersteunde talen: Arabisch, Chinees (Vereenvoudigd), Engels, Frans, Duits, Hindi, Italiaans, Japans, Koreaans, Portugees, Russisch en Spaans. Chinees is hier Vereenvoudigd, geen aparte doelvariëteit Traditioneel. Portugees is één doeltaal, niet opgesplitst per land. Staat de taal die je nodig hebt niet in die lijst, dan verzint deze stap hem niet. Kies een doeltaal die de tool daadwerkelijk biedt, of vertaal de geëxporteerde tekst ergens waar die taal wel wordt geboden, en accepteer dat de tweede tool de tijdcodes misschien niet behoudt, tenzij je ze zelf meeneemt.

De brontaal is wat de ondertitels of de spraak al waren. Een video die in het Japans wordt gesproken, komt eerst terug als Japanse regels, ook als je van plan bent Spaans te lezen. De vertaling is een latere keuze van doeltaal, en een andere doeltaal is een aparte vertaling van dezelfde bronregels. Overschakelen van Spaans naar Duits bewerkt het Spaanse resultaat niet om tot Duits. Het vertaalt de bron opnieuw.

Automatische ondertiteling is, als die er is, nog steeds de bron. De kwaliteit hangt volledig af van dat ondertitelbestand. Het gaat mis bij namen, accenten en snelle terzijdes. Transcriberen vanaf de audio, bij een video die nooit ondertiteld is, heeft dezelfde beperking: de tekst volgt de opname. Vertaal pas nadat je de bronregel hebt bekeken die je belangrijk vindt, niet ervoor.

Tijdcodes uitgelijnd houden

De tijd blijft staan, omdat de vertaling de tijdlijn niet opnieuw opbouwt. Elke regel behoudt de starttijd en de duur die hij had voordat de bewoording veranderde. Alleen de tekst wordt vervangen. Een zin die begon op 1:02 begint in de vertaling nog steeds op 1:02, ook als de nieuwe bewoording langer of korter is dan het origineel.

Originele en vertaalde transcriptregels naast elkaar met dezelfde tijdstempels

Zo blijft de vertaling verbonden met het moment in de video. De vertaalde regel is een label op het oorspronkelijke moment, geen nieuwe weergave met een eigen tempo. De tijd naast de regel is nog steeds dat moment in de bronvideo. Je hoort de oorspronkelijke spraak en je leest de vertaling. Je hoort geen ingesproken stem, want er is geen nieuwe audio gemaakt.

De export gebruikt diezelfde tijden. TXT van de vertaling bevat alleen de vertaalde woorden, één regel per cue, zonder de tijden. SRT en VTT behouden een start en een eind, zodat een editor of webspeler de vertaalde cue kan tonen. Het eind is het eind van de oorspronkelijke regel, bijgesneden zodat het niet overlapt met de volgende cue. Een speler toont dan één regel tegelijk in plaats van twee op elkaar te stapelen.

Een langere vertaling is het onderdeel dat mensen verkeerd begrijpen. De cue groeit niet mee met de nieuwe zin. De woorden moeten binnen het oorspronkelijke venster passen. Een korte Engelse regel die een lange Duitse regel wordt, eindigt nog steeds wanneer de oorspronkelijke cue eindigt. Op het scherm kan een speler meer tekst in diezelfde tijdsspanne wikkelen. Het bestand heeft de video niet opnieuw getimed naar een stem die de vertaling uitspreekt. Als je later een nasynchronisatie opneemt, time je die zelf. Deze export doet dat niet voor je.

De reader kan de starttijd naast elke vertaalde regel tonen terwijl je die controleert. Het kopiëren van de passage, zoals bij de TXT-export, neemt de woorden mee en laat de tijden weg. Als de tijd met de zin mee moet, gebruik dan de SRT of VTT, of noteer de tijd naast de zin die je in je notities plakt. De uitlijning is alleen nuttig als je die aan de regel vast houdt die je gaat citeren.

Clean, als je die uitvoert, is een aparte bewerking. Die herstelt grammatica, interpunctie en herkenningsfouten in de tekst en behoudt de tijden. Het is geen vertaling. Translate is de bewerking die de taal verandert. Voer Clean uit op de bron wanneer een regel door elkaar loopt, en vertaal daarna, zodat je geen herkenningsfout omzet in een zelfverzekerde verkeerde zin in de andere taal.

Veelgemaakte fouten

De gebruikelijke fout is het verkeerde object vertalen. Titels op het scherm, met een camera gefilmde slides en ondertitels die in het beeld zijn gebrand, staan niet in het transcript en komen dus niet in de andere taal terug. Als de betekenis van de video in die beelden zit en de stem die nooit uitspreekt, haalt de vertaling die er niet uit. Je leest dan alleen spraak.

Controles voor het exporteren van een vertaald transcript: tekst in beeld, geen nieuwe stem, namen en cijfers, en lange regels in dezelfde cue

De volgende fout is verwachten dat je een nieuwe soundtrack krijgt. Vertaal YouTube video naar tekst en wat je overhoudt is de bewoording. Je krijgt geen vervangende stem, geen lipsynchronisatie en geen tijdlijn die rond de lengte van de vertaalde zin is opgebouwd. De oorspronkelijke audio blijft de klok. Een nasynchronisatie is een aparte montage.

Een andere fout is een korte navertelling vertalen en dan tijden per regel verwachten. Samenvatting, Kernpunten en Hoofdstukssamenvatting zijn kortere weergaven van hetzelfde transcript. Ze zijn handig voordat je elke regel leest. Het zijn niet het vertaalde transcript, en ze geven je geen tijdsgebonden cue per gesproken regel. De vertaling die uitgelijnd blijft, werkt op de transcriptregels zelf. Study Notes, Meeting Summary, Creator Repurpose, Moments en MindMap zijn andere weergaven van die tekst. Geen daarvan is de taalverandering. MindMap kan een knooppunt naar een moment laten wijzen, wat helpt bij het navigeren. Het is nog steeds niet de vertaalde bewoording van elke regel.

Eigennamen, getallen en uitdrukkingen vragen om een menselijke blik. Een naam kan getranslitereerd, half vertaald of gelaten worden zoals hij klonk. Een grap die afhangt van de oorspronkelijke taal overleeft een letterlijke regel-voor-regel-weergave niet. Voordat je de vertaling citeert als wat de spreker zei, open je de tijdcodering en luister je. De vertaling is een weergave van de regel. De opname is de bron.

Snelle spraak in een korte cue heeft dezelfde praktische beperking als een lange vertaling. Het venster is bepaald door de oorspronkelijke regel. Als je de SRT in een editor laadt en de vertaalde cue voelt krap, splits of herschrijf die cue dan in de editor. Verwacht niet dat de export het moment heeft verlengd.

Een video met bijna geen spraak vertaalt naar bijna niets. Stilte, muziek en applaus zijn geen zinnen. Als het transcript een handvol regels is, is de vertaling een handvol regels. Dat is een eigenschap van de bron, niet een mislukte doeltaal.

Als het transcript nooit begint, begint de vertaling nooit. De gebruikelijke oorzaak is een video die niet openbaar bereikbaar is.

Is de bestemming een getimed ondertitelspoor voor een speler, exporteer dan SRT of VTT van de vertaalde regels. De pagina over het maken van zo'n spoor op basis van een YouTube-link, als ondertiteling in plaats van als leestekst, is de YouTube-ondertitelgenerator. Gebruik dit artikel wanneer de taak de vertaalde bewoording is, inclusief het getimede bestand van die bewoording. Gebruik de ondertitelgenerator wanneer de taak het ondertitelspoor zelf is.

Als de overlay voldoende is, kijk dan met de overlay. Heb je de woorden in een andere taal nodig én het oorspronkelijke moment erbij, genereer dan het transcript, vertaal de regels en behoud de tijden. De YouTube transcript generator is waar die openbare link de tekst wordt die je vervolgens vertaalt.

Transcriberen

Zet elke video om in tekst

Plak een YouTube-, TikTok- of Instagram-link en lees het transcript, met tijdstempels op elke regel.

Exporteert als TXT, SRT of VTT.