**인터뷰 녹취 방법: 녹취 수준·화자 표시·표기법**
Source: https://sozai.app/ko/how-to-transcribe-an-interview/

[전사](https://sozai.app/ko/category/jeonsa/)

# 인터뷰 녹취록 작성법: 녹취 수준, 화자 표시, 표기법

10월 2, 2026  • 2 min read • 15 views  • 마지막 업데이트: 10월 2, 2026

![Two chairs facing each other at a small table by a window, a phone recording between them next to a notebook](https://sozai.app/wp-content/uploads/post-how-to-transcribe-an-interview-1280x720.webp)

> ### 핵심 요약
>
>
>
> 한 글자도 입력하기 전에 녹취 수준부터 정하세요. 완전 녹취(Full Verbatim)는 “음”, “어” 같은 군말과 말 더듬기를 모두 남기고, 정리 녹취(Clean Verbatim)는 군말을 빼고 뜻만 남기며, 편집본은 읽기 좋게 문법까지 다듬습니다. 휴지, 겹침 발화, 알아들을 수 없는 구간을 표시하는 표기법을 정해 문서 맨 위에 범례로 적어 두고, 화자 표시는 일관되게 하세요. 직접 입력하면 Texas Tech University Libraries의 구술사 가이드는 녹음 1시간당 6시간, Cornell University의 강의 안내서는 4~6시간으로 봅니다. 자동 녹취는 몇 분 만에 초안을 주고, 사람이 하는 일은 입력에서 녹음과 대조하는 검수로 옮겨 갑니다.

녹음 파일이 있습니다. 이제 누군가 인용하고, 코딩하고, 제출할 수 있는 녹취록을 원합니다. 가장 먼저 물어야 할 것은 어떤 앱을 쓸지가 아니라 말을 얼마나 남길지입니다.

군말과 말 끊김은 대화 분석과 일부 법적 상황에서는 중요하지만 그 밖에서는 잡음일 뿐입니다. 이 글은 세 가지 녹취 수준, 휴지와 겹침 발화를 표시하는 표기법, 직접 작업할 때 걸리는 시간, 그리고 실제 녹음에서 자동 녹취가 무엇을 맞히고 무엇을 틀리는지 차례로 다룹니다.

## 인터뷰를 가장 쉽게 녹취하는 방법은?

먼저 녹음을 음성 인식 엔진에 돌린 다음, 이름을 고치고, 오디오와 표본 대조를 하고, 프로젝트에 필요한 표기를 더하세요. 빈 화면에서 시작해 입력하는 것보다 빠르고, 대부분의 사람이 말하는 ‘가장 쉬운 방법’도 바로 이것입니다. 한 시간 분량의 말을 처음부터 한 단어씩 입력하는 것은 쉬운 길이 아니라 느린 길입니다.

짧은 클립이라면 브라우저 도구 [인터뷰 온라인 녹취](https://sozai.app/ko/tools/transcribe-interview/) 가 계정 없이 이 첫 단계를 해 줍니다. 녹음을 올리면 앞의 5분을 녹취하고, 각 발화에 타임스탬프와 함께 Speaker A, Speaker B 같은 표시를 붙이며, 99개 언어 중에서 언어를 자동으로 감지합니다. 25 MB 이하 파일은 그대로 처리되고, 더 긴 녹음은 무엇이든 전송하기 전에 브라우저에서 5분으로 잘립니다. 결과가 돌아오면 오디오와 녹취문은 제공업체 쪽에서 삭제되며, 미리 보기는 기기당 하루 3회 가능합니다.

특정 녹음에 이 도구가 쓸 만한지 확인하기에는 충분합니다. 인터뷰 전체를 한 번에, 처음부터 끝까지 화자를 표시하고 모든 녹취문을 검색 가능한 보관함에 남기려면 SozAI 앱을 쓰면 되며, 처음 30분은 무료입니다. 전체 그림은 [인터뷰 녹취가 작동하는 방식](https://sozai.app/ko/interview-transcription/) 에서 확인하시거나 [앱을 다운로드](https://sozai.app/ko/download/) 하세요.

## Verbatim과 Clean Verbatim은 어떻게 다른가요?

완전 녹취(Full Verbatim)는 말한 그대로 모든 단어를 남깁니다. 군말, 말 끊김, 반복된 단어, 말 더듬기, 들리는 웃음까지 포함합니다. 정리 녹취(Clean Verbatim)는 화자의 말과 뜻은 남기되 군말, 말 끊김, 무심코 한 반복은 뺍니다. 편집본은 한 걸음 더 나아가 문법과 문장 순서를 다듬어 읽기 좋게 만드는데, 바로 그 때문에 실제로 무슨 말이 오갔는지 보여 주는 증거로는 쓸 수 없게 됩니다.

- 완전 녹취(Full Verbatim): 대화 분석, 일부 법적·증거 작업.
- 정리 녹취(Clean Verbatim): 대부분의 질적 연구, 저널리즘, 사용자 리서치.
- 편집본: 지면에 실리는 문답 기사.

| 수준 | 남기는 것 | 주된 용도 |
| --- | --- | --- |
| 완전 녹취(Full Verbatim) | 말한 그대로의 모든 단어: 군말, 말 끊김, 반복, 말 더듬기, 들리는 소리 | 대화 분석, 일부 법적·증거 작업 |
| 정리 녹취(Clean Verbatim) | 화자의 말과 뜻, 군말과 말 끊김은 제외 | 대부분의 질적 연구, 저널리즘, 사용자 리서치 |
| 편집본 | 읽기 좋게 다듬은 문법과 문장 순서 | 지면에 실리는 문답 기사 |

녹취록을 발행 글이 아니라 연구 프로젝트에 쓴다면, 다섯 번째 인터뷰 뒤가 아니라 첫 인터뷰 전에 이것을 정하세요. 중간에 수준을 바꾸면 앞선 녹취록을 다시 맞춰야 합니다. 동의, 익명화, 보관 같은 연구 측면은 [연구용 인터뷰 녹취](https://sozai.app/ko/interview-transcript-for-research/) 에서 다룹니다.

## 인터뷰 녹취록은 어떻게 쓰나요?

범례로 시작하세요. 녹취 수준, 사용하는 기호, 화자를 표시하는 방식을 첫 발화 줄 앞, 문서 맨 위에 적습니다. 나중에 녹취록을 코딩하거나 인용하는 사람에게 이 범례가 필요하고, 몇 주 뒤 (.)가 무슨 뜻이었는지 잊은 당신에게도 필요합니다.

상세 녹취록으로 가장 잘 알려진 체계는 Gail Jefferson이 만든 것으로, [Glossary of transcript symbols with an introduction](https://doi.org/10.1075/pbns.125.02jef) (2004)에 정리되어 있습니다. [Clift, Kendrick, Raymond, Robinson(2024)](https://eprints.whiterose.ac.uk/id/eprint/237652/1/Clift_Kendrick_Raymond_Robinson._2024_-_Jeffersonian_Transcription_conventions.pdf) 의 요약에 따르면, 왼쪽 대괄호는 겹쳐 말하기가 시작되는 지점을, 등호는 틈 없이 이어지는 발화를, (0.5)처럼 괄호 안의 숫자는 초 단위로 잰 침묵을, (.)는 재기에는 너무 짧은 휴지를 나타냅니다. 마이크로 휴지가 정확히 얼마나 짧은지는 자료마다 달라서, 범례에서 (.)를 쓴다면 그것이 무엇을 뜻하는지 적어 두어야 합니다.

대부분의 인터뷰 프로젝트는 이 정도의 세부 표기가 필요 없고, 없는 편이 읽기 쉽습니다. 실제로 자주 나오는 경우는 대괄호 규칙으로 충분합니다. 알아듣지 못한 구간에는 다시 찾을 수 있도록 타임스탬프를 붙여 [inaudible 00:12:31], 두 사람이 동시에 말하면 [crosstalk], 웃음 같은 비언어 사건은 [laughs]처럼 대괄호로 표시하고, 모든 발화의 시작에 화자 표시를 둡니다.

| 기호 | 의미 | 체계 |
| --- | --- | --- |
| [ | 겹쳐 말하기가 시작되는 지점 | Jefferson |
| = | 틈 없이 이어지는 발화(latching) | Jefferson |
| (0.5) | 초 단위로 잰 침묵 | Jefferson |
| (.) | 재기에는 너무 짧은 휴지 | Jefferson |
| [inaudible 00:12:31] | 알아들을 수 없는 구간, 타임스탬프 포함 | 대괄호 |
| [crosstalk] | 두 사람이 동시에 말함 | 대괄호 |
| [laughs] | 비언어 소리 | 대괄호 |

표기법 외에도 [UK Data Service의 녹취 지침](https://dam.ukdataservice.ac.uk/media/187730/transcriptiondm25april2013.pdf) 은 녹취록에 고유 식별자를 달고, 프로젝트 전체에 같은 레이아웃을 쓰고, 발화 교대에는 화자 태그를 쓰며, 줄바꿈을 유지하라고 합니다. 사소해 보이지만, 나중에 전부 다시 읽는 대신 녹취록을 찾고 비교할 수 있게 해 주는 것이 바로 이런 것들입니다.

화자 표시는 녹취 소프트웨어가 알 수 없는 이름입니다. Speaker A, Speaker B로 나오리라 예상하고, 누가 누구인지 알게 되면 직접 이름을 바꾸세요. 프로젝트 전체에서 파일마다 이름이 달라지지 않게 하는 방법은 [화자를 일관되게 표시하기](https://sozai.app/ko/who-said-what-transcript/) 에서 다룹니다.

익명화는 나중이 아니라 작업하면서 하세요. 이름과 식별 정보를 녹취록 안에서 바로 [Participant 2]나 [city] 같은 일관된 자리표시자로 바꾸고, 자리표시자와 실제 이름을 잇는 대응표는 별도 파일에 보관합니다. 사람을 녹음하려면 거의 어디서나 본인의 동의가 필요하고, 연구윤리위원회는 대개 서면 동의를 요구합니다. 녹음을 글로 옮긴다고 이 요건이 달라지지는 않습니다.

## 인터뷰 녹취에는 얼마나 걸리나요?

직접 입력한다면 분이 아니라 시간 단위로 잡으세요. [Texas Tech University Libraries 구술사 가이드](https://guides.library.ttu.edu/c.php?g=1275281&p=9356352) 는 숙련된 녹취자도 오디오 1시간당 보통 6시간을 입력에 쓴다고 합니다. [Cornell University 강의 안내서](https://courses2.cit.cornell.edu/fit117/CP_T.htm) 는 이보다 낮은 녹음 1시간당 4~6시간으로 보는데, 차이는 대개 오디오가 얼마나 깨끗한지와 작업하면서 표기를 얼마나 더하는지에서 나옵니다.

자동 녹취는 시간이 사라지게 하는 것이 아니라 시간이 쓰이는 곳을 바꿉니다. 초안은 몇 분 만에 돌아오고, 남는 일은 녹음과 맞춰 들어 보며 이름과 전문 용어를 고치고, 화자 표시가 뒤바뀐 곳에서 누가 무슨 말을 했는지 바로잡고, 프로젝트에 필요한 표기를 더하는 것입니다. 1시간짜리 인터뷰라면 여전히 실제 작업이지만 종류가 다릅니다. [녹취에 실제로 걸리는 시간](https://sozai.app/ko/how-long-will-transcription-take/) 에서 더 자세히 풀어 놓았습니다.

## ChatGPT로 인터뷰를 녹취할 수 있나요?

챗봇이 오디오 파일을 텍스트로 바꿀 수 있는지는 제품에 따라 다릅니다. 하지만 인터뷰 녹취록에는 텍스트 이상이 필요합니다. 되돌아갈 수 있는 타임스탬프와 믿을 수 있는 발화 구분인데, 이는 녹취 엔진이 만들어 내도록 설계된 것입니다. 챗봇이 제 몫을 하는 것은 그 다음, 이미 가진 녹취록을 다듬고, 요약하고, 형식을 바꿀 때입니다.

어느 쪽이든 자동으로 만든 텍스트는 인용하기 전에 녹음과 대조해야 하며, 이 검수는 어떤 도구도 없애 주지 못합니다.

특정 엔진에 얼마나 검수가 필요한지는 꽤 차이가 납니다. [AI 녹취는 얼마나 정확한가](https://sozai.app/ko/how-accurate-is-ai-transcription/) 에서 기대할 수 있는 수준과 오류가 몰리는 곳을 다룹니다.

## 실제 자동 녹취록이 틀리는 것

자동 녹취록은 초안이며, 그 뜻을 가장 분명히 보는 방법은 하나를 돌려 녹음과 맞춰 읽어 보는 것입니다. 2026년 10월 2일에 우리가 바로 그렇게 했습니다. 이 글과 대조해 누구나 확인할 수 있는 공개 녹음의 앞 5분이 대상이었습니다.

NASA Johnson Space Center의 팟캐스트 Houston We Have a Podcast 180회 “Artemis Mission Management”(진행자 Gary Jordan, 게스트 Mike Sarafin)의 앞 5분(300초)에 SozAI 인터뷰 도구 뒤의 엔진을 돌렸습니다. NASA의 저작물이라 저작권 보호를 받지 않습니다. 결과는 778단어였고, 영어로 감지했으며, 화자 2명을 찾았습니다. 엔진이 내놓은 첫 줄들은 다음과 같습니다.

[00:00] Speaker A: Houston, we have a podcast. Welcome to the official podcast of the NASA Johnson Space Center, episode 180, Artemis Mission Management. I'm Gary Jordan, and I'll be your host today.
[01:19] Speaker B: T-minus five seconds and counting. Mark.
[01:22] Speaker A: Launch commit lights are correct. There she goes. Houston. We have a podcast. Mike Serafin, thanks for coming on Houston, We Have a Podcast today.
[01:36] Speaker B: Thank you. It's a pleasure to be here to talk about these exciting Artemis missions we have ahead of us. Yeah, right?
[01:43] Speaker A: Returning to the Moon. Not a bad thing to be a part of.

이 다섯 발화만 봐도 세 군데는 사람의 손질이 필요했습니다. 01:19의 발사 카운트다운과 01:22의 “Launch commit lights are correct. There she goes.”는 팟캐스트에 끼워 넣은 발사 아카이브 음성이지 진행자나 게스트가 말한 것이 아닌데, 엔진은 이를 각각 Speaker B와 Speaker A로 표시했습니다. 01:36 발화 끝의 “Yeah, right?”는 사실 대화를 다시 이어받는 진행자의 말이어서, 게스트 발화의 끝이 아니라 다음 발화의 처음에 속합니다. 그리고 게스트의 성은 여기서 Serafin으로 나왔지만, 해당 회차의 크레딧에는 Sarafin으로 적혀 있습니다.

뒤쪽의 한 발화는 정리 녹취(Clean Verbatim)가 무엇을 위한 것인지 보여 줍니다. 02:51에서 엔진의 출력은 이렇습니다. “Yes, so you’re, you’re right in that I lived in the operations realm for 22 of my 27 years in, in my NASA career.” 정리 녹취로 다듬으면 “You’re right in that I lived in the operations realm for 22 of my 27 years in my NASA career.”가 됩니다. 완전 녹취(Full Verbatim)는 반복을 나온 그대로 남길 것입니다. 이 엔진은 오히려 반복을 남기는 쪽이어서 파일 전체에서 대부분의 반복과 말 끊김을 그대로 두었고(“you’re, you’re right”, “in, in my NASA career”, “That’s, that’s quite a number of”), 그 결과물은 정리 녹취보다 완전 녹취에 더 가깝습니다. 프로젝트에 정리 녹취가 필요하다면 어느 엔진이 초안을 만들든 편집 단계를 예산에 넣으세요.

답변

## Frequently Asked Questions

인터뷰를 가장 쉽게 녹취하는 방법은?

첫 초안은 음성 인식 엔진에 맡기고, 그다음 오디오와 대조하며 화자 이름과 불분명한 단어를 고치세요. 처음부터 손으로 입력하는 것은 쉬운 길이 아니라 더 느린 길입니다. SozAI의 인터뷰 녹취 같은 브라우저 도구는 계정 없이 앞 5분의 화자 표시와 타임스탬프가 붙은 초안을 만들어 주므로, 전체 파일을 돌려 볼 가치가 있는지 판단하기에 충분합니다.

완성된 인터뷰 녹취록은 어떤 모습이어야 하나요?

녹취 수준, 사용한 표기, 화자 표시 방식을 밝히는 짧은 범례로 시작하고, 이어서 타임스탬프가 붙은 Speaker A 같은 표시의 발화가 나옵니다. UK Data Service의 녹취 지침은 여기에 고유 식별자, 통일된 레이아웃, 화자 태그, 줄바꿈이 있어야 전체를 다시 읽지 않고도 나중에 찾고 비교할 수 있다고 덧붙입니다.

ChatGPT로 인터뷰를 녹취할 수 있나요?

제품에 따라 다르며, 첫 단계에는 맞지 않는 도구입니다. 인터뷰 녹취록에는 타임스탬프와 믿을 수 있는 발화 구분이 필요한데, 이는 녹취 엔진이 만들어 내는 것입니다. 챗봇은 이미 가진 녹취록을 다듬고, 요약하고, 형식을 바꾸는 단계에서 유용하며, 자동으로 만든 텍스트는 어느 경우든 녹음과 대조해야 합니다.

Verbatim과 Clean Verbatim 중 무엇을 써야 하나요?

모든 군말, 말 끊김, 반복이 중요한 대화 분석이나 법적·증거 작업에는 완전 녹취(Full Verbatim)를, 말투의 흐트러짐보다 뜻이 더 중요한 대부분의 질적 연구, 저널리즘, 사용자 리서치에는 정리 녹취(Clean Verbatim)를 쓰세요. 중간에 바꾸면 앞선 녹취록을 다시 해야 하므로 첫 인터뷰 전에 정하세요.

녹취록에서 알아들을 수 없는 부분은 어떻게 표시하나요?

[inaudible 00:12:31]처럼 타임스탬프와 함께 [inaudible]이라고 적어, 본인이나 다른 사람이 나중에 녹음에서 그 지점을 다시 찾을 수 있게 하세요. 겹쳐 말하기에는 [crosstalk], 웃음 같은 비언어 소리에는 [laughs]를 쓰고, 모두 대괄호 안에 넣어 녹취록 맨 위 범례에 한 번 설명합니다.

1시간짜리 인터뷰를 녹취하는 데는 얼마나 걸리나요?

직접 입력하면 Texas Tech University Libraries 구술사 가이드는 오디오 1시간당 약 6시간의 입력을, Cornell University 강의 안내서는 4~6시간을 잡습니다. 자동 녹취는 몇 분 만에 초안을 돌려주며, 남은 시간은 입력이 아니라 녹음과 대조하는 검수에 쓰입니다.

![Merey Tleugazin](https://sozai.app/wp-content/themes/sozai/assets/images/merey-tleugazin.webp)

[Merey Tleugazin](https://sozai.app/about/merey/)

SozAI의 창립자. 전 세계 전문가를 위해 음성을 텍스트로 바꾸는 도구를 만들고 있습니다.

- [Instagram](https://instagram.com/mereytleugazin)
- [X](https://x.com/mereytleugazin)

## 관련 글

- [8월 2 1 min ### 녹음된 통화 내용을 텍스트로 바꾸기](https://sozai.app/ko/transcribe-a-recorded-call/)
- [8월 2 1 min ### 영상 속 발언을 다시 타이핑하지 않고 에세이에 인용하는 법](https://sozai.app/ko/quote-a-video-in-an-essay/)
- [7월 19 1 min ### 오디오를 텍스트로 변환하는 방법 (무료로 실제 효과 있는 방법)](https://sozai.app/ko/how-to-transcribe-audio-to-text/)

[![SozAI](https://sozai.app/wp-content/themes/sozai/assets/images/appicon.png) SozAI — 무료 다운로드 오디오와 비디오를 즉시 텍스트로 변환 앱 받기](https://sozai.app/ko/download/)


---
This is the markdown twin of https://sozai.app/ko/how-to-transcribe-an-interview/ — the same content, without the markup.
Published by SozAI (https://sozai.app). Reuse and quotation are allowed with attribution and a link back.
Machine-readable index: https://sozai.app/llms.txt · data API: https://sozai.app/api/
