Spring til indhold
Research 4 min læsning

Gør specialeinterviews til kodet tekst hurtigere

En kandidatstuderende optager interviews og fokusgrupper og bruger derefter automatiske taleretiketter til at omdanne lange optagelser til læsbare transskriptioner. På tværs af SozAI indeholder 99 % af transskriptionerne taleretiketter.

Filer på op til 2,8 timer
99 % indeholder taleretiketter
20+ sprog behandlet

Kort sagt

En masterstuderende optager interviews og fokusgrupper på en iPhone eller Android-enhed, uploader hver lyd- eller videofil til SozAI og modtager tekst med automatiske talerlabels. SozAI behandler en 50-minutters optagelse på cirka fem minutter. Den studerende gennemgår taleridentifikation, kontrollerer centrale passager og eksporterer transskriptionen som TXT, DOCX, PDF, SRT eller VTT til kvalitativ kodning.

Opsætningen

Hvem
Masterstuderende, der gennemfører specialeinterviews og fokusgrupper
Typisk optagelse
En-til-en-interviews og fokusgrupper med flere talere
Omfang
Filer på op til 500 MB og cirka 2.8 timer
Sprog
100+ understøttes; 20+ indgår i brugen
Enheder
iPhone, Android, macOS eller webstedet
Anvendt eksport
DOCX eller TXT til kvalitativ kodning
Lagring
Datacentre i EU; AES-256-kryptering ved lagring

Tallene stammer fra anonymiserede samlede data fra SozAI's produktionsbrug og det offentlige transskriptionsbibliotek, ikke fra én navngiven organisation.

Manuel transskription forsinker kodningen

I specialeforskning fortsætter arbejdet efter hvert interview. En kandidatstuderende kan optage enkeltinterviews og fokusgrupper med overlappende svar, opfølgende spørgsmål og flere deltagere i rummet.

Før analysen kan begynde, skal hver optagelse gennemgås, transskriberes og tilskrives de rette personer. Manuel indtastning og gentagen gennemlytning sinker kodning, temaudvikling og vejlederens gennemgang.

Denne samlede case afspejler anonymiserede brugsmønstre fra reel produktionsaktivitet i SozAI. Den repræsenterer forskere, der har brug for transskriptioner, de kan læse, fremhæve og flytte ind i en kvalitativ analyseproces.

De har også brug for understøttelse af lange optagelser, tydelig adskillelse mellem talere og eksportmuligheder, der passer til en eksisterende kodningsworkflow.

De begrænsninger forskere møder

99%
af transskriptioner indeholder taleretiketter
2.8 hours
maksimal behandlet fillængde
20+
sprog brugt på tværs af transskriptioner

Fra optagelse til tekst klar til kodning

Den studerende uploader hvert interview eller hver fokusgruppeoptagelse til SozAI fra en iPhone- eller Android-enhed. Appen omdanner lyd eller video til tekst og adskiller automatisk talere, så det bliver lettere at skelne mellem en moderator og flere respondenter.

Den studerende gennemgår nøglepassager og eksporterer derefter transskriptionen til kvalitativ kodning. Den samme proces understøtter flersprogede projekter på tværs af de 20+ sprog, der indgår i brugen af SozAI.

Når samtalen er organiseret efter taler, kan den studerende gå fra rå optagelser til temamærkning, sammenligning af svar og dokumentation til specialet med mindre manuel transskription.

Et praktisk forskningsworkflow

  1. 1 Optag et specialeinterview eller en fokusgruppe på en telefon, eller optag det som video.
  2. 2 Upload filen til SozAI til transskription med automatiske taleretiketter.
  3. 3 Gennemgå nøglepassager, og kontroller moderatorens og respondenternes afsnit.
  4. 4 Eksportér teksten, og før den ind i den kvalitative kodningsproces.

Mindre tid mellem optagelse og analyse

Forskningsmetoden forbliver den samme. Den studerende får hurtigere brugbar tekst, så kodning og skrivning kan begynde uden at vente på en fuldt manuel transskription.

En hurtigere første gennemgang

Den studerende skimmer, annoterer og organiserer en transskription i stedet for gentagne gange at lytte og skrive.

Tydeligere tilskrivning

Automatiske taleretiketter hjælper med at adskille moderatorens spørgsmål fra deltagernes svar i interviews og fokusgrupper.

En direkte vej til kodning

Den studerende eksporterer brugbar tekst og flytter den ind i den kvalitative analyseproces.

Det, der understøttede workflowet

Taleretiketter til forskningssamtaler

Da 99 % af transskriptionerne indeholder taleretiketter, passer SozAI til interviews og fokusgrupper, hvor tilskrivning er vigtig.

Understøttelse af lange sessioner

SozAI behandler filer på op til 2,8 timer og dækker længere interviews, workshops og gruppediskussioner.

Dækning på tværs af sprog

SozAI har behandlet indhold på 20+ sprog og understøtter flersproget akademisk forskning.

Hvor lang tid hvert trin tager

  1. Optag sessionenOp til cirka 2.8 timer pr. fil

    Den studerende optager et interview eller en fokusgruppe som lyd eller video på en iPhone eller Android-enhed. Hver uploadet fil kan være på op til 500 MB.

  2. Upload og transskriberCirka fem minutter for en 50-minutters optagelse

    SozAI omdanner optagelsen til tekst med cirka 10x realtidshastighed. Automatisk sproggenkendelse vælger blandt de 100+ understøttede sprog.

  3. Gennemgå talerafsnitEfter behandlingen

    Den studerende kontrollerer moderatorens og respondenternes passager, især når talerne overlapper i fokusgruppen. Automatisk diarisation giver talerlabels i 99% af de transskriptioner, der produceres i appen.

  4. Eksportér til kodningEfter gennemgang

    Den studerende eksporterer den gennemgåede transskription som TXT, DOCX, PDF, SRT eller VTT. Tidskoder på ordniveau indgår i de eksporterede transskriptionsformater, der understøtter dem.

Hvad denne arbejdsgang ikke gør

Overlappende tale reducerer nøjagtigheden

SozAI kan ikke pålideligt skelne mellem alle overlappende svar i en fokusgruppe. Nøjagtigheden på ordniveau falder, når talere taler i munden på hinanden, har kraftig accent, optager med baggrundsstøj eller bruger lyd i telefonkvalitet.

Talerlabels er ikke deltagernes identitet

SozAI kan ikke udlede en deltagers navn af optagelsen alene. Talerlabels adskiller stemmer, men den studerende skal kontrollere, hvilken label der tilhører moderatoreren eller hver enkelt respondent.

Menneskelig gennemgang er fortsat nødvendig

SozAI erstatter ikke kontrol af forskningsmaterialet op mod optagelsen. Den studerende skal gennemgå citater, uklare passager, taleridentifikation og afsnit, der er påvirket af dårlig lyd, før de kodes eller citeres.

SozAI udfører ikke kvalitativ kodning

SozAI producerer transskriptionen og dens eksporter; tjenesten tildeler ikke forskningskoder, udvikler temaer og erstatter ikke den studerendes kvalitative analyseproces.

Termer brugt på denne side

Diarisation
Diarisation er den automatiske opdeling af en transskription i afsnit med talerlabels.
Talerlabel
En talerlabel angiver, hvilken registreret stemme der har frembragt en passage, uden nødvendigvis at identificere personens navn.
Tidskode på ordniveau
En tidskode på ordniveau registrerer placeringen af et enkelt ord i den oprindelige optagelse.
SRT og VTT
SRT og VTT er tidsindstillede eksportformater til undertekster, som kobler transskriptionstekst til placeringer i en lyd- eller videofil.

Et mønster i forskningsbrug

Denne samlede case afspejler anonymiserede brugsmønstre på tværs af 5,400+ brugere. Forskere bruger SozAI til at omdanne optagede samtaler til tekst, de kan læse, kode og citere.

Den praktiske fordel er enkel: mindre tid brugt på at skrive optagelser af og mere tid til analyse, skrivning og gennemgang.

Svar

Spørgsmål om denne arbejdsgang

Hvordan transskriberer SozAI specialeinterviews?

SozAI transskriberer en uploadet lyd- eller videooptagelse og returnerer læsbar tekst med automatiske talerlabels. En masterstuderende kan optage på en iPhone eller Android-enhed, uploade filen, gennemgå moderatorens og respondenternes afsnit og eksportere resultatet som TXT, DOCX, PDF, SRT eller VTT til kvalitativ kodning.

Kan SozAI adskille talere i en fokusgruppe?

SozAI tilbyder automatisk diarisation, som opdeler registrerede stemmer i talerlabels. På tværs af SozAI indeholder 99% af de transskriptioner, der produceres i appen, talerlabels. Den studerende skal stadig kontrollere labels op mod optagelsen, fordi overlappende tale, baggrundsstøj, kraftige accenter og lyd i telefonkvalitet reducerer nøjagtigheden på ordniveau og kan påvirke taleridentifikationen.

Hvor lang tid tager det for SozAI at transskribere et 50-minutters interview?

SozAI arbejder cirka 10x hurtigere end realtid, så en 50-minutters optagelse er typisk klar på cirka fem minutter. Behandlingstiden fjerner ikke behovet for gennemgang: Den studerende bør kontrollere uklare ord, overlappende svar, taleridentifikation og citater, før transskriptionen bruges i specialeanalysen.

Hvilken filstørrelse og optagelængde kan SozAI håndtere?

SozAI accepterer filer på op til 500 MB og op til cirka 2.8 timer pr. fil. Den studerende kan indsende en interview- eller fokusgruppeoptagelse inden for disse grænser som lyd eller video og derefter modtage en transskription med talerlabels, når diarisation er tilgængelig for optagelsen.

Hvilken SozAI-eksport bør jeg bruge til kvalitativ kodning?

SozAI eksporterer transskriptioner som TXT, DOCX, PDF, SRT og VTT. TXT eller DOCX giver redigerbar tekst til fremhævning og kodning, mens SRT og VTT bevarer strukturen for tidsindstillede undertekster. SozAI leverer også tidskoder på ordniveau, så den studerende kan finde transskriptionspassager i den oprindelige optagelse.

Understøtter SozAI flersprogede specialeinterviews?

SozAI understøtter 100+ sprog og har automatisk sproggenkendelse. Mere end 20 sprog indgår i faktisk brug af SozAI, så en studerende kan anvende den samme transskriptionsproces på tværs af flersprogede interviews eller fokusgrupper. Nøjagtigheden afhænger fortsat af optagekvalitet, accent, baggrundsstøj og overlappende tale.

Begynd at transskribere dine forskningsinterviews

Upload et specialeinterview eller en fokusgruppe, og få tekst med taleretiketter, som du kan gennemgå og eksportere.