Spring til indhold

Hvor lang tid tager det at transskribere en optagelse på to timer?

9 min read 1 views Sidst opdateret: aug 2, 2026
A phone lying on a kitchen table showing an audio waveform, a notepad and pencil beside it

Kort fortalt

For en optagelse på to timer tager selve den automatiske transskription kun en brøkdel af den tid – det er ikke softwaren, der er den begrænsende faktor. Det, der afgør, hvor din aften går, er korrekturlæsningen bagefter: et groft, søgbart udkast kræver næsten ingen oprydning, mens en tekst, du skal citere eller udgive, kræver en fuld gennemlytning mod lydsporet, hvor navne, tal og overlappende tale rettes til. Skriver du det i hånden i stedet, tager det flere gange optagelsens længde, og det bliver værre med dårlig lydkvalitet. Sæt tid af til korrekturen, ikke til softwaren.

To timers tale, i det tempo de fleste mennesker taler, giver et sted mellem seksten og atten tusind ord – nogenlunde længden af en kort bog. Det tal siger i sig selv noget om aftenen, der venter: ingen vil læse det hele igennem i ét stræk, og næsten ingen vil skrive det fra bunden, hvis der findes en anden vej.

Det ærlige svar på, hvor lang tid det tager, afhænger af to ting, du selv har kontrol over, og én du ikke har: hvor ren lyden er, hvor ren den færdige transskription skal være, og hvor hurtigt du selv skriver eller lytter. Software ændrer på det ene af de forhold. Den rører ikke ved de to andre.

Regn det ud først

Foredrag og oplæg ligger typisk på 130 til 150 ord i minuttet. Almindelig samtale går hurtigere og mere ujævnt – folk taler i munden på hinanden, starter sætninger om og løber tør for tanken midtvejs. Ved foredragstempo giver en times tale omkring otte til ni tusind ord. Dobbelt op for en optagelse på to timer, og du ender på seksten til atten tusind ord rå tekst – mere, hvis det er en diskussion snarere end én person, der taler.

Det er før du overhovedet har besluttet, hvordan teksten skal blive til noget. Vil du hurtigt have en fornemmelse af ordantallet for din egen optagelse, før du binder dig til noget, kan en beregner til taletid give dig svaret på et minut – det er værd at gøre, før aftenen går i gang, fordi en optagelse på femten minutter og et møde på to timer er forskellige opgaver, der føles ens, indtil man faktisk har målt dem. Du kan lave det overslag med beregneren til taletid.

At skrive det selv tager længere tid, end man tror

Overvejer du at skrive det ud i hånden i aften, skal du kende den reelle faktor, du går ind til. At skrive en transskription i hånden tager flere gange optagelsens længde – ikke fordi selve det at skrive er langsomt, men fordi man ikke kan lytte i talefart og skrive korrekt på samme tid. Man stopper lyden, spoler et par sekunder tilbage, skriver det, man hørte, og starter igen. Det gentager sig hele tiden, og det bliver værre med ukendte ord, hurtigere tale eller steder, hvor to personer taler samtidig.

Faktoren vokser med lydens sværhedsgrad, den bliver ikke mindre. Et rent interview i almindeligt samtaletempo kan løbe op i tre eller fire gange sin egen længde, når man tæller alt stop og tilbagespoling med. Et foredrag fyldt med faglige udtryk, du ikke allerede kender, kan løbe langt forbi det, fordi du hele tiden stopper for at finde ud af stavning og formuleringer, du ellers ville skrive lige igennem. For to timers lyd er håndskrivning ikke en opgave, man klarer på en aften. Det er en opgave, der strækker sig over flere aftener, og det er bedre at vide det, før man starter, end en time inde i det.

Automatisk transskription bliver ikke langsommere – den bliver dårligere

Det er den del, der overrasker folk, første gang de prøver det. Automatisk transskription tager ikke længere tid, når lyden er svær. Den bruger nogenlunde samme behandlingstid, uanset om optagelsen er én tydelig stemme i et stille rum eller tre personer, der diskuterer over en dårlig telefonforbindelse. Det, der ændrer sig med sværere lyd, er kvaliteten af resultatet, ikke tiden det tager at producere det.

Det er både godt og skidt nyt i samme åndedrag. Godt, fordi du ikke skal vente længere ved dårligere forhold – softwaren er færdig på sin egen tid uanset hvad. Skidt, fordi den tid, du sparer i den ende, ikke forsvinder, den flytter sig til den anden ende – til hvor meget rettelse transskriptionen kræver bagefter. Noget som det system, der ligger bag konvertering fra lyd til tekst, giver dig et komplet dokument for en fil på to timer hurtigt. Om det dokument er tæt på færdigt, eller kræver en omhyggelig gennemgang, afhænger helt af, hvad der kom ind i mikrofonen – ikke af, hvordan softwaren håndterede det.

Det er korrekturen, der afgør din aften

Det er det tal, ingen sætter af, og det er det, der betyder mest. En transskription, du laver for at kunne søge i den senere – for at finde det sted, hvor nogen nævnte en dato, eller for at skimme efter en beslutning, der blev taget – kræver næsten ingen rettelse. Man læser hen over de små fejl, fordi man allerede nogenlunde ved, hvad der skal stå. For en optagelse på to timer kan den slags gennemgang tage tyve minutter at skimme og bekræfte, at den kan bruges.

En transskription, du har tænkt dig at citere, udgive eller give til en, der ikke selv var i rummet, er en helt anden opgave. Den kræver en fuld gennemlytning mod lydsporet, sætning for sætning, fordi en fejl i et citat er en anden slags problem end en fejl i en privat note til dig selv. For to timers lydoptagelse tager en omhyggelig gennemgang som den næsten to timer af din egen tid, nogle gange mere, hvis materialet er tungt eller fagligt.

Fejlene er ikke jævnt fordelt over optagelsen, hvilket er den ene rigtig gode nyhed her. Navne, faglige udtryk, tal og overlappende tale er der, hvor det automatiske resultat rent faktisk kikser. Det meste af en optagelse på to timer kommer tilbage stort set korrekt, og en håndfuld minutter – typisk hvor to personer taler i munden på hinanden, eller nogen ramler et tal af sted hurtigt – kræver reel opmærksomhed. Ved du nogenlunde, hvor de minutter ligger, kan du gå direkte til dem i stedet for at læse hele dokumentet igennem fra start til slut. Kører du dine egne tal først, baseret på optagelsens længde og hvad du faktisk skal bruge transskriptionen til, gennem en beregner til transskriptionstid, får du en plan, der ligger tættere på virkeligheden end et gæt lavet, før du er gået i gang.

At dele filen op sparer ikke tid, men det redder aftenen

At klippe en optagelse på to timer op i fire stykker af en halv time hver, før man transskriberer, gør ikke selve opgaven hurtigere. Regnestykket fra afsnittene ovenfor ændrer sig ikke – du transskriberer stadig to timers tale og retter det, der skal rettes, uanset hvordan du skærer filen op. Det, der ændrer sig, er om arbejdet kan afbrydes.

En enkelt fil på to timer er i praksis én arbejdsgang, fordi det, at åbne den igen senere, betyder, at man skal lede efter, hvor man kom til, i en mur af tekst uden naturlige pauser. Fire separate filer giver fire arbejdsgange, og du kan færdiggøre en i aften, en i morgen og resten i næste uge, uden at tabe tråden i, hvor du slap. For en optagelse så lang – lang nok til at de fleste ikke realistisk kan klare hele den i ét stræk – betyder den mulighed for at afbryde mere end den fart, man vinder ved at behandle stykker parallelt. Skal du lave korrekturen ordentligt, så planlæg at dele den op i stedet for at forvente, at du sætter dig ned én gang og bliver færdig.

En app, der klarer hele filen på én gang, i stedet for at bede dig om selv at stå for opdelingen, er en mulighed, det er værd at kende til her. Transskriptionsappen fås via download-siden til iOS, Android og macOS, og den tager lyd, video, optagelser eller et YouTube-link og returnerer tekst med talermærkning, et resumé og oversættelse på tværs af mange sprog – én vej blandt de flere beskrevet ovenfor, ikke en genvej udenom selve korrekturen.

Det, der ikke følger med, realistisk set

Automatisk transskription kender ikke dine talere ved navn, med mindre du fortæller den det. Den sætter en mærkat på i stedet for et navn, den ingen mulighed har for at gætte, og det bliver den ved med, indtil nogen retter det. Den fanger heller ikke sikkert et navn, den aldrig har set stavet ud, et udtryk, der er specifikt for dit fagområde, eller et tal sagt hurtigt midt i en fartfyldt sætning. Det er præcis de steder, korrekturen altid samler sig om, og ingen mængde beregningskraft kommer udenom dem.

Overlappende tale er tæt på uoprettelig, uanset hvilken vej du vælger. Når to personer taler samtidig, taber både automatisk transskription og en person, der skriver i hånden, noget af det – softwaren binder sig til den ene tråd og taber den anden, og en person, der skriver, har samme problem, blot langsommere. Har en optagelse på to timer lange stræk med overlappende samtale, så sæt ekstra korrekturtid af specifikt til de stræk, og forvent ikke, at nogen af metoderne giver dig en ren læsning af begge stemmer på én gang.

Selve overslaget på to timer er et udgangspunkt, ikke en garanti. En optagelse med jævnt tempo, én taler og velkendte fagudtryk bevæger sig hurtigere gennem hvert trin beskrevet her end en med tre personer, en dårlig mikrofon og et emne, du ikke allerede kender godt. Regnestykket ovenfor giver dig en plan for aftenen. Det lover ikke, at du bliver færdig med den på én.

Svar

Frequently Asked Questions

Hvor mange ord er en times tale?

Foredrag og oplæg ligger typisk på 130 til 150 ord i minuttet, hvilket giver omkring otte til ni tusind ord for en times tale. Almindelig samtale går hurtigere og mere ujævnt, så en diskussion eller et interview kan ende med at blive længere, afhængigt af hvor mange der taler og hvor hurtigt.

Hvor meget længere tid tager det at skrive en transskription i hånden?

At skrive en transskription i hånden tager typisk flere gange optagelsens længde, fordi man hele tiden skal stoppe, spole tilbage og afspille lyden igen for at fange alt. Den faktor vokser med dårlig lydkvalitet og ukendte fagudtryk, så en teknisk snak tager langt længere at skrive end en klar, afslappet samtale af samme længde.

Gør dårlig lyd automatisk transskription langsommere?

Nej. Automatisk transskription tager nogenlunde samme tid, uanset om lyden er ren eller svær, fordi softwaren ikke går i stå ved svære passager. Det, der ændrer sig, er nøjagtigheden af resultatet, ikke tiden det tager at producere det, så den reelle pris for dårlig lyd viser sig først bagefter, under korrekturen.

Hvor meget tid skal jeg sætte af til at rette en transskription?

Det afhænger helt af, hvad transskriptionen skal bruges til. En version, du kun skal søge i eller skimme, kræver næsten ingen rettelse. En version, du skal citere eller udgive, kræver en fuld gennemlytning mod lydsporet, hvilket for en optagelse på to timer kan tage næsten to timer, koncentreret mest om navne, tal og overlappende tale.

Går det hurtigere at transskribere en lang optagelse i mindre stykker?

At dele en optagelse op i kortere stykker mindsker ikke den samlede mængde arbejde, fordi du stadig transskriberer og retter samme mængde tale uanset hvad. Det, der ændrer sig, er om opgaven kan afbrydes, hvilket betyder mest for lange optagelser, hvor det ikke er realistisk at blive færdig med det hele i ét stræk.

Hvordan estimerer jeg dette for min egen optagelse?

Start med længden af din optagelse og et typisk taletempo for at få et groft ordantal, og beslut derefter, hvad transskriptionen faktisk skal bruges til, da det valg styrer det meste af tidsforbruget. Sætter du både længden og formålet ind i en beregner, får du et mere præcist estimat end at gætte på baggrund af afspilningstiden alene.

Merey Tleugazin

Grundlægger af SozAI. Bygger værktøjer, der omdanner tale til tekst for professionelle verden over.

SozAI
SozAI — Gratis downloadTransskriber lyd og video med det samme
Hent app