Ga naar de inhoud

Gratis tool

Regeleinden verwijderen: transcriptie opschonen

Verwijder regeleinden, tijdstempels, geluidstags en stopwoorden uit een transcriptie en krijg leesbare alinea's. Plak, kies wat je wilt opschonen, kopieer het resultaat.

  • Werkt in je browser
  • Niets wordt geüpload
  • Geen registratie

Wat opschonen
Lijst met stopwoorden

Standaard staan alleen geluiden in de lijst die nooit betekenis dragen. Woorden als "zeg maar" of "weet je" zijn ook gewone woorden — voeg ze zelf toe als je ze weg wilt hebben. Zinnen van meerdere woorden werken ook.

Werkt in je browser — de tekst wordt niet geüpload. De opschoner kan geen leestekens toevoegen die er niet zijn: automatisch gegenereerde ondertitels hebben geen punten, dus controleer het resultaat voordat je het publiceert.

Zo werkt het

Regeleinden verwijderen: transcriptie opschonen in drie stappen

01

Plak de transcriptie

Uit onze YouTube-transcriptietool, het transcriptiepaneel van YouTube of een SRT- of VTT-bestand.

02

Kies wat je opschoont

Tijdstempels, afgebroken regels, geluidstags, stopwoorden, sprekerlabels – elk is een schakelaar.

03

Kopieer nette alinea's

Het resultaat wordt bijgewerkt als je opties wijzigt. Kopieer het of download een .txt-bestand.

Wat de cleaner verwijdert

Een transcriptie die uit een videospeler is gekopieerd, is gemaakt om mee te volgen, niet om te lezen: om de paar seconden een tijdstempel, een regeleinde waar de ondertitel eindigde, [Music] midden in een zin. De cleaner haalt dat steigerwerk weg en geeft je alinea's. Elke optie kan uit en het resultaat wordt bijgewerkt terwijl je typt.

Typische invoer en wat de cleaner ervan maakt
OptieVoorNa
Tijdstempels verwijderen[02:14] dus het eersteDus het eerste
Tijdstempels verwijderen (ondertitelbestand)12 / 00:00:41,200 --> 00:00:43,900 / tekstTekst
Afgebroken regels samenvoegenhet brein bewaart
wat het gebruikt
Het brein bewaart wat het gebruikt
Geluidstags verwijderenhet sterft weg [Applause] snelHet sterft weg snel
Stopwoorden verwijderenDus, eh, ik denk, ehm, jaDus, ik denk, ja
Sprekerlabels verwijderenSpeaker 1: HalloHallo

Welke formaten hij begrijpt

  • Onze YouTube-transcriptie – de kopie met [mm:ss] Speaker A: voor elk segment. Segmenten van dezelfde spreker worden samengevoegd en het sprekerlabel wordt één keer per alinea geschreven.
  • Het transcriptiepaneel van YouTube zelf – de tijd op de ene regel, de woorden op de volgende. Tijdregels vervallen, ook de uitgesproken vorm die sommige kopieën hebben ("1 minute, 5 seconds").
  • SRT-, WebVTT- en SBV-ondertitelbestanden – cuenummers, timingregels, VTT-headers, notities en inline tags verdwijnen; een VTT-voicetag wordt een sprekerlabel; de herhaalde regel bovenaan elke cue van automatische ondertitels wordt verwijderd.
  • Vergadernotities met een naam en een tijd op een eigen regel ("Speaker 1 0:03") worden "Speaker 1:".

Alleen tijdstempels die op tijdstempels lijken worden verwijderd: aan het begin van een regel, op een eigen regel of tussen haakjes. "We spreken af om 10:30" midden in een zin blijft zoals het is.

Hoe alinea's worden herbouwd

Komt de tekst uit een speler, dan wordt elk regeleinde behandeld als het einde van een ondertitel in plaats van een alinea, dus de regels worden eerst samengevoegd. Een woord dat met een koppelteken over twee regels was gesplitst, wordt weer aan elkaar gezet. Daarna begint elke 3, 4, 5, 6 of 8 zinnen een nieuwe alinea (standaard 4), en altijd als de spreker wisselt. Tekst die je zelf hebt getypt, behoudt zijn alinea's met witregel.

Automatisch gegenereerde ondertitels hebben meestal helemaal geen punten, dus er zijn geen zinnen om te tellen. Als een tekst gemiddeld meer dan 60 woorden per zin heeft, knipt de cleaner alinea's in plaats daarvan op lengte – ongeveer 20 woorden voor elke zin die je vroeg – en meldt dat.

"Spaties en hoofdletters herstellen" verwijdert dubbele spaties en spaties voor komma's en punten, voegt een ontbrekende spatie na een komma toe en zet de eerste letter van elke zin in hoofdletters. Afkortingen als "Dr." en initialen als "U.S.A." beëindigen geen zin, en woorden als "iPhone" behouden hun eerste letter.

Stopwoorden, zorgvuldig

De standaardlijsten bevatten alleen aarzelgeluiden – "um", "uh", "erm" in het Engels, "э", "эм" in het Russisch, "äh", "ähm" in het Duits – voor tien talen: Engels, Russisch, Oekraïens, Spaans, Portugees, Frans, Duits, Italiaans, Pools en Nederlands. De taal van de pagina kiest de lijst. Woorden als "like", "you know" of "o sea" zijn met opzet weggelaten: het zijn ook gewone woorden, en ze blind verwijderen verandert de betekenis. Voeg ze zelf toe aan de lijst als je ze kwijt wilt; ook uitdrukkingen van meerdere woorden werken, en je lijst wordt in deze browser onthouden.

Eerlijke beperkingen

De cleaner ruimt tekst op, hij begrijpt hem niet. Hij kan geen leestekens toevoegen die de bron nooit had, kan verkeerd verstane woorden niet herstellen, en een regel die begint met een woord met hoofdletter en een dubbele punt ("Note: …") kan voor een sprekerlabel worden aangezien – die optie staat standaard uit. Lees het resultaat voordat je het publiceert. Alles draait in je browser; de tekst wordt niet geüpload of opgeslagen.

Antwoorden

Transcriptie opschonen – veelgestelde vragen

Hoe verwijder ik regeleinden uit een transcriptie?

Plak de tekst en laat “Afgebroken regels samenvoegen” aan. Regels die midden in een zin zijn afgebroken, worden tot alinea's samengevoegd, woorden die met een koppelteken waren gesplitst worden weer aan elkaar gezet en nieuwe alinea's beginnen om de paar zinnen of als de spreker wisselt.

Hoe verwijder ik tijdstempels uit een YouTube-transcriptie?

Plak hem met “Tijdstempels verwijderen” aan. Beide formaten werken: het transcriptiepaneel van YouTube met de tijd op een eigen regel en het [mm:ss]-formaat dat onze YouTube-transcriptietool kopieert. Tijden midden in een zin blijven met rust.

Kan ik een SRT- of VTT-bestand opschonen tot platte tekst?

Ja. Plak het of open het bestand: cuenummers, timingregels, VTT-headers en opmaaktags worden verwijderd, de herhaalde regels van automatische YouTube-ondertitels vervallen en de tekst wordt tot alinea's samengevoegd.

Welke stopwoorden worden verwijderd?

Alleen aarzelgeluiden, zoals um, uh en erm in het Engels, uit ingebouwde lijsten voor tien talen. Woorden als “like” of “you know” staan niet op de lijst omdat het ook echte woorden zijn. Je kunt de lijst bewerken en elk woord of elke uitdrukking toevoegen.

Waarom worden mijn alinea's op rare plekken afgebroken?

Waarschijnlijk omdat de tekst geen zinsleestekens heeft – typisch voor automatisch gegenereerde ondertitels. Zonder punten zijn er geen zinnen om te tellen, dus alinea's worden op lengte geknipt. Kies “Alinea's laten zoals ze zijn” om dit uit te zetten.

Voegt het ontbrekende leestekens toe?

Nee. Het herstelt spaties en zet zinsbegin in hoofdletters, maar kan geen punten en komma's verzinnen die er nooit waren. Voor een goed van leestekens voorziene transcriptie transcribeer je beter de audio zelf dan automatische ondertitels op te schonen.

Wordt mijn tekst geüpload?

Nee. Het opschonen gebeurt in je browser en de tekst wordt nergens heen gestuurd of opgeslagen. Alleen je optiekeuzes en eigen stopwoordenlijsten worden op dit apparaat onthouden.

Volledige transcriptie nodig?

Upload audio of plak een YouTube-link en ontvang een volledig AI-transcript met sprekerlabels, tijdstempels en samenvattingen.

Download de app — gratis

Gratis op iOS en Android. Geen account nodig.