콘텐츠로 건너뛰기

인터뷰 녹취록 작성법: 녹취 수준, 화자 표시, 표기법

•2 min read• 14 views •마지막 업데이트: 10월 2, 2026
Two chairs facing each other at a small table by a window, a phone recording between them next to a notebook

핵심 요약

한 글자도 입력하기 전에 녹취 수준부터 정하세요. 완전 녹취(Full Verbatim)는 “음”, “어” 같은 군말과 말 더듬기를 모두 남기고, 정리 녹취(Clean Verbatim)는 군말을 빼고 뜻만 남기며, 편집본은 읽기 좋게 문법까지 다듬습니다. 휴지, 겹침 발화, 알아들을 수 없는 구간을 표시하는 표기법을 정해 문서 맨 위에 범례로 적어 두고, 화자 표시는 일관되게 하세요. 직접 입력하면 Texas Tech University Libraries의 구술사 가이드는 녹음 1시간당 6시간, Cornell University의 강의 안내서는 4~6시간으로 봅니다. 자동 녹취는 몇 분 만에 초안을 주고, 사람이 하는 일은 입력에서 녹음과 대조하는 검수로 옮겨 갑니다.

녹음 파일이 있습니다. 이제 누군가 인용하고, 코딩하고, 제출할 수 있는 녹취록을 원합니다. 가장 먼저 물어야 할 것은 어떤 앱을 쓸지가 아니라 말을 얼마나 남길지입니다.

군말과 말 끊김은 대화 분석과 일부 법적 상황에서는 중요하지만 그 밖에서는 잡음일 뿐입니다. 이 글은 세 가지 녹취 수준, 휴지와 겹침 발화를 표시하는 표기법, 직접 작업할 때 걸리는 시간, 그리고 실제 녹음에서 자동 녹취가 무엇을 맞히고 무엇을 틀리는지 차례로 다룹니다.

인터뷰를 가장 쉽게 녹취하는 방법은?

먼저 녹음을 음성 인식 엔진에 돌린 다음, 이름을 고치고, 오디오와 표본 대조를 하고, 프로젝트에 필요한 표기를 더하세요. 빈 화면에서 시작해 입력하는 것보다 빠르고, 대부분의 사람이 말하는 ‘가장 쉬운 방법’도 바로 이것입니다. 한 시간 분량의 말을 처음부터 한 단어씩 입력하는 것은 쉬운 길이 아니라 느린 길입니다.

짧은 클립이라면 브라우저 도구 인터뷰 온라인 녹취가 계정 없이 이 첫 단계를 해 줍니다. 녹음을 올리면 앞의 5분을 녹취하고, 각 발화에 타임스탬프와 함께 Speaker A, Speaker B 같은 표시를 붙이며, 99개 언어 중에서 언어를 자동으로 감지합니다. 25 MB 이하 파일은 그대로 처리되고, 더 긴 녹음은 무엇이든 전송하기 전에 브라우저에서 5분으로 잘립니다. 결과가 돌아오면 오디오와 녹취문은 제공업체 쪽에서 삭제되며, 미리 보기는 기기당 하루 3회 가능합니다.

특정 녹음에 이 도구가 쓸 만한지 확인하기에는 충분합니다. 인터뷰 전체를 한 번에, 처음부터 끝까지 화자를 표시하고 모든 녹취문을 검색 가능한 보관함에 남기려면 SozAI 앱을 쓰면 되며, 처음 30분은 무료입니다. 전체 그림은 인터뷰 녹취가 작동하는 방식에서 확인하시거나 앱을 다운로드하세요.

Verbatim과 Clean Verbatim은 어떻게 다른가요?

완전 녹취(Full Verbatim)는 말한 그대로 모든 단어를 남깁니다. 군말, 말 끊김, 반복된 단어, 말 더듬기, 들리는 웃음까지 포함합니다. 정리 녹취(Clean Verbatim)는 화자의 말과 뜻은 남기되 군말, 말 끊김, 무심코 한 반복은 뺍니다. 편집본은 한 걸음 더 나아가 문법과 문장 순서를 다듬어 읽기 좋게 만드는데, 바로 그 때문에 실제로 무슨 말이 오갔는지 보여 주는 증거로는 쓸 수 없게 됩니다.

  • 완전 녹취(Full Verbatim): 대화 분석, 일부 법적·증거 작업.
  • 정리 녹취(Clean Verbatim): 대부분의 질적 연구, 저널리즘, 사용자 리서치.
  • 편집본: 지면에 실리는 문답 기사.
세 가지 녹취 수준과 각각 남기는 것
수준남기는 것주된 용도
완전 녹취(Full Verbatim)말한 그대로의 모든 단어: 군말, 말 끊김, 반복, 말 더듬기, 들리는 소리대화 분석, 일부 법적·증거 작업
정리 녹취(Clean Verbatim)화자의 말과 뜻, 군말과 말 끊김은 제외대부분의 질적 연구, 저널리즘, 사용자 리서치
편집본읽기 좋게 다듬은 문법과 문장 순서지면에 실리는 문답 기사

녹취록을 발행 글이 아니라 연구 프로젝트에 쓴다면, 다섯 번째 인터뷰 뒤가 아니라 첫 인터뷰 전에 이것을 정하세요. 중간에 수준을 바꾸면 앞선 녹취록을 다시 맞춰야 합니다. 동의, 익명화, 보관 같은 연구 측면은 연구용 인터뷰 녹취에서 다룹니다.

인터뷰 녹취록은 어떻게 쓰나요?

범례로 시작하세요. 녹취 수준, 사용하는 기호, 화자를 표시하는 방식을 첫 발화 줄 앞, 문서 맨 위에 적습니다. 나중에 녹취록을 코딩하거나 인용하는 사람에게 이 범례가 필요하고, 몇 주 뒤 (.)가 무슨 뜻이었는지 잊은 당신에게도 필요합니다.

상세 녹취록으로 가장 잘 알려진 체계는 Gail Jefferson이 만든 것으로, Glossary of transcript symbols with an introduction(2004)에 정리되어 있습니다. Clift, Kendrick, Raymond, Robinson(2024)의 요약에 따르면, 왼쪽 대괄호는 겹쳐 말하기가 시작되는 지점을, 등호는 틈 없이 이어지는 발화를, (0.5)처럼 괄호 안의 숫자는 초 단위로 잰 침묵을, (.)는 재기에는 너무 짧은 휴지를 나타냅니다. 마이크로 휴지가 정확히 얼마나 짧은지는 자료마다 달라서, 범례에서 (.)를 쓴다면 그것이 무엇을 뜻하는지 적어 두어야 합니다.

대부분의 인터뷰 프로젝트는 이 정도의 세부 표기가 필요 없고, 없는 편이 읽기 쉽습니다. 실제로 자주 나오는 경우는 대괄호 규칙으로 충분합니다. 알아듣지 못한 구간에는 다시 찾을 수 있도록 타임스탬프를 붙여 [inaudible 00:12:31], 두 사람이 동시에 말하면 [crosstalk], 웃음 같은 비언어 사건은 [laughs]처럼 대괄호로 표시하고, 모든 발화의 시작에 화자 표시를 둡니다.

녹취 표기: Jefferson 기호와 더 간단한 대괄호 규칙
기호의미체계
[겹쳐 말하기가 시작되는 지점Jefferson
=틈 없이 이어지는 발화(latching)Jefferson
(0.5)초 단위로 잰 침묵Jefferson
(.)재기에는 너무 짧은 휴지Jefferson
[inaudible 00:12:31]알아들을 수 없는 구간, 타임스탬프 포함대괄호
[crosstalk]두 사람이 동시에 말함대괄호
[laughs]비언어 소리대괄호

표기법 외에도 UK Data Service의 녹취 지침은 녹취록에 고유 식별자를 달고, 프로젝트 전체에 같은 레이아웃을 쓰고, 발화 교대에는 화자 태그를 쓰며, 줄바꿈을 유지하라고 합니다. 사소해 보이지만, 나중에 전부 다시 읽는 대신 녹취록을 찾고 비교할 수 있게 해 주는 것이 바로 이런 것들입니다.

화자 표시는 녹취 소프트웨어가 알 수 없는 이름입니다. Speaker A, Speaker B로 나오리라 예상하고, 누가 누구인지 알게 되면 직접 이름을 바꾸세요. 프로젝트 전체에서 파일마다 이름이 달라지지 않게 하는 방법은 화자를 일관되게 표시하기에서 다룹니다.

익명화는 나중이 아니라 작업하면서 하세요. 이름과 식별 정보를 녹취록 안에서 바로 [Participant 2]나 [city] 같은 일관된 자리표시자로 바꾸고, 자리표시자와 실제 이름을 잇는 대응표는 별도 파일에 보관합니다. 사람을 녹음하려면 거의 어디서나 본인의 동의가 필요하고, 연구윤리위원회는 대개 서면 동의를 요구합니다. 녹음을 글로 옮긴다고 이 요건이 달라지지는 않습니다.

인터뷰 녹취에는 얼마나 걸리나요?

직접 입력한다면 분이 아니라 시간 단위로 잡으세요. Texas Tech University Libraries 구술사 가이드는 숙련된 녹취자도 오디오 1시간당 보통 6시간을 입력에 쓴다고 합니다. Cornell University 강의 안내서는 이보다 낮은 녹음 1시간당 4~6시간으로 보는데, 차이는 대개 오디오가 얼마나 깨끗한지와 작업하면서 표기를 얼마나 더하는지에서 나옵니다.

자동 녹취는 시간이 사라지게 하는 것이 아니라 시간이 쓰이는 곳을 바꿉니다. 초안은 몇 분 만에 돌아오고, 남는 일은 녹음과 맞춰 들어 보며 이름과 전문 용어를 고치고, 화자 표시가 뒤바뀐 곳에서 누가 무슨 말을 했는지 바로잡고, 프로젝트에 필요한 표기를 더하는 것입니다. 1시간짜리 인터뷰라면 여전히 실제 작업이지만 종류가 다릅니다. 녹취에 실제로 걸리는 시간에서 더 자세히 풀어 놓았습니다.

ChatGPT로 인터뷰를 녹취할 수 있나요?

챗봇이 오디오 파일을 텍스트로 바꿀 수 있는지는 제품에 따라 다릅니다. 하지만 인터뷰 녹취록에는 텍스트 이상이 필요합니다. 되돌아갈 수 있는 타임스탬프와 믿을 수 있는 발화 구분인데, 이는 녹취 엔진이 만들어 내도록 설계된 것입니다. 챗봇이 제 몫을 하는 것은 그 다음, 이미 가진 녹취록을 다듬고, 요약하고, 형식을 바꿀 때입니다.

어느 쪽이든 자동으로 만든 텍스트는 인용하기 전에 녹음과 대조해야 하며, 이 검수는 어떤 도구도 없애 주지 못합니다.

특정 엔진에 얼마나 검수가 필요한지는 꽤 차이가 납니다. AI 녹취는 얼마나 정확한가에서 기대할 수 있는 수준과 오류가 몰리는 곳을 다룹니다.

실제 자동 녹취록이 틀리는 것

자동 녹취록은 초안이며, 그 뜻을 가장 분명히 보는 방법은 하나를 돌려 녹음과 맞춰 읽어 보는 것입니다. 2026년 10월 2일에 우리가 바로 그렇게 했습니다. 이 글과 대조해 누구나 확인할 수 있는 공개 녹음의 앞 5분이 대상이었습니다.

NASA Johnson Space Center의 팟캐스트 Houston We Have a Podcast 180회 “Artemis Mission Management”(진행자 Gary Jordan, 게스트 Mike Sarafin)의 앞 5분(300초)에 SozAI 인터뷰 도구 뒤의 엔진을 돌렸습니다. NASA의 저작물이라 저작권 보호를 받지 않습니다. 결과는 778단어였고, 영어로 감지했으며, 화자 2명을 찾았습니다. 엔진이 내놓은 첫 줄들은 다음과 같습니다.

[00:00] Speaker A: Houston, we have a podcast. Welcome to the official podcast of the NASA Johnson Space Center, episode 180, Artemis Mission Management. I'm Gary Jordan, and I'll be your host today.
[01:19] Speaker B: T-minus five seconds and counting. Mark.
[01:22] Speaker A: Launch commit lights are correct. There she goes. Houston. We have a podcast. Mike Serafin, thanks for coming on Houston, We Have a Podcast today.
[01:36] Speaker B: Thank you. It's a pleasure to be here to talk about these exciting Artemis missions we have ahead of us. Yeah, right?
[01:43] Speaker A: Returning to the Moon. Not a bad thing to be a part of.

이 다섯 발화만 봐도 세 군데는 사람의 손질이 필요했습니다. 01:19의 발사 카운트다운과 01:22의 “Launch commit lights are correct. There she goes.”는 팟캐스트에 끼워 넣은 발사 아카이브 음성이지 진행자나 게스트가 말한 것이 아닌데, 엔진은 이를 각각 Speaker B와 Speaker A로 표시했습니다. 01:36 발화 끝의 “Yeah, right?”는 사실 대화를 다시 이어받는 진행자의 말이어서, 게스트 발화의 끝이 아니라 다음 발화의 처음에 속합니다. 그리고 게스트의 성은 여기서 Serafin으로 나왔지만, 해당 회차의 크레딧에는 Sarafin으로 적혀 있습니다.

뒤쪽의 한 발화는 정리 녹취(Clean Verbatim)가 무엇을 위한 것인지 보여 줍니다. 02:51에서 엔진의 출력은 이렇습니다. “Yes, so you’re, you’re right in that I lived in the operations realm for 22 of my 27 years in, in my NASA career.” 정리 녹취로 다듬으면 “You’re right in that I lived in the operations realm for 22 of my 27 years in my NASA career.”가 됩니다. 완전 녹취(Full Verbatim)는 반복을 나온 그대로 남길 것입니다. 이 엔진은 오히려 반복을 남기는 쪽이어서 파일 전체에서 대부분의 반복과 말 끊김을 그대로 두었고(“you’re, you’re right”, “in, in my NASA career”, “That’s, that’s quite a number of”), 그 결과물은 정리 녹취보다 완전 녹취에 더 가깝습니다. 프로젝트에 정리 녹취가 필요하다면 어느 엔진이 초안을 만들든 편집 단계를 예산에 넣으세요.

답변

Frequently Asked Questions

인터뷰를 가장 쉽게 녹취하는 방법은?

첫 초안은 음성 인식 엔진에 맡기고, 그다음 오디오와 대조하며 화자 이름과 불분명한 단어를 고치세요. 처음부터 손으로 입력하는 것은 쉬운 길이 아니라 더 느린 길입니다. SozAI의 인터뷰 녹취 같은 브라우저 도구는 계정 없이 앞 5분의 화자 표시와 타임스탬프가 붙은 초안을 만들어 주므로, 전체 파일을 돌려 볼 가치가 있는지 판단하기에 충분합니다.

완성된 인터뷰 녹취록은 어떤 모습이어야 하나요?

녹취 수준, 사용한 표기, 화자 표시 방식을 밝히는 짧은 범례로 시작하고, 이어서 타임스탬프가 붙은 Speaker A 같은 표시의 발화가 나옵니다. UK Data Service의 녹취 지침은 여기에 고유 식별자, 통일된 레이아웃, 화자 태그, 줄바꿈이 있어야 전체를 다시 읽지 않고도 나중에 찾고 비교할 수 있다고 덧붙입니다.

ChatGPT로 인터뷰를 녹취할 수 있나요?

제품에 따라 다르며, 첫 단계에는 맞지 않는 도구입니다. 인터뷰 녹취록에는 타임스탬프와 믿을 수 있는 발화 구분이 필요한데, 이는 녹취 엔진이 만들어 내는 것입니다. 챗봇은 이미 가진 녹취록을 다듬고, 요약하고, 형식을 바꾸는 단계에서 유용하며, 자동으로 만든 텍스트는 어느 경우든 녹음과 대조해야 합니다.

Verbatim과 Clean Verbatim 중 무엇을 써야 하나요?

모든 군말, 말 끊김, 반복이 중요한 대화 분석이나 법적·증거 작업에는 완전 녹취(Full Verbatim)를, 말투의 흐트러짐보다 뜻이 더 중요한 대부분의 질적 연구, 저널리즘, 사용자 리서치에는 정리 녹취(Clean Verbatim)를 쓰세요. 중간에 바꾸면 앞선 녹취록을 다시 해야 하므로 첫 인터뷰 전에 정하세요.

녹취록에서 알아들을 수 없는 부분은 어떻게 표시하나요?

[inaudible 00:12:31]처럼 타임스탬프와 함께 [inaudible]이라고 적어, 본인이나 다른 사람이 나중에 녹음에서 그 지점을 다시 찾을 수 있게 하세요. 겹쳐 말하기에는 [crosstalk], 웃음 같은 비언어 소리에는 [laughs]를 쓰고, 모두 대괄호 안에 넣어 녹취록 맨 위 범례에 한 번 설명합니다.

1시간짜리 인터뷰를 녹취하는 데는 얼마나 걸리나요?

직접 입력하면 Texas Tech University Libraries 구술사 가이드는 오디오 1시간당 약 6시간의 입력을, Cornell University 강의 안내서는 4~6시간을 잡습니다. 자동 녹취는 몇 분 만에 초안을 돌려주며, 남은 시간은 입력이 아니라 녹음과 대조하는 검수에 쓰입니다.

Merey Tleugazin

SozAI의 창립자. 전 세계 전문가를 위해 음성을 텍스트로 바꾸는 도구를 만들고 있습니다.

SozAI
SozAI — 무료 다운로드오디오와 비디오를 즉시 텍스트로 변환
앱 받기