**研究访谈转录指南：细节该留还是该删**
Source: https://sozai.app/zh/interview-transcript-for-research/

[笔记](https://sozai.app/zh/category/biji/)

# 研究访谈转录：如何做到不丢失关键数据

8 月 2, 2026  • 1 min read • 81 views  • 最后更新： 8 月 2, 2026

![A desk with a handheld voice recorder, a printed sheet, a pen and an open laptop showing text](https://sozai.app/wp-content/uploads/post-interview-transcript-for-research-1280x720.webp)

> ### 核心要点
>
>
>
> 动笔转录前，先确定你需要的细节程度。如果你的分析关注的是“说了什么”，一份清晰、可读的转录稿就够用了。如果关注的是“怎么说的”，就必须保留停顿、重叠和犹豫，而自动转录恰恰会把这些细节抹掉。上传录音之前，先查清楚知情同意书和伦理审批对录音去向有什么规定。匿名化处理应该在转录稿上做，不要动录音本身；对应表要单独保存；并善用时间戳，确保引用内容可以溯源。

没有人告诉你“标准做法”是什么，是因为根本不存在唯一标准。标准有好几种，具体适用哪一种，取决于你拿到转录稿之后打算怎么用它。这是一个方法论上的决定，应该在挑选工具之前想清楚，而不是之后。

顺序一旦搞反，代价是实打实的。你干净利落地转录完六份访谈，进入分析阶段才发现自己需要知道受访者在哪里犹豫了一下，于是又要拿着六段录音重新听一遍，这次换了个听法。所以，先花一个小时想清楚这个问题。

## 动笔之前，先想清楚这份转录稿是拿来做什么的

转录稿需要多细，是一个方法论问题，不是看你做事认不认真、够不够仔细。它取决于你采用的分析方法。

如果你的分析关心的是“说了什么”，一份干净的转录稿就足够。你需要的是准确的文字内容，并且归属到正确的发言人。填充词、说话说到一半改口、短暂停顿，这些都可以整理掉而不损失什么，因为它们本来就不会出现在你的编码里。大多数主题分析和内容导向的研究都属于这一类，干净的转录稿写起来更快，读起来更快，编码也更快。

如果你的分析关心的是“怎么说的”，情况就反过来了。停顿、重叠、犹豫，两个人抢话的那一刻，答案出来前的那三秒钟，说到一半又重新组织语言——这些就是数据本身。转录稿如果把这些去掉了，就等于把你要研究的东西去掉了。这一点对自动转录尤其重要，因为它最擅长的恰恰就是把这些细节抹平，输出流畅、易读的文字。但流畅易读的文字，对于一段犹豫不决、互相打断的对话来说，是一种失真的呈现。

有一种诱惑，是把所有内容都转录到最细的程度，想着反正用不上的部分可以不看。这个想法通常是错的。精细转录很慢，二十份访谈的精细转录会吃掉你根本没有的几个月时间。它还会让转录稿更难读，编码也更慢。如果你现在确实还不知道互动细节对你的分析重不重要，这是该现在就去找导师聊一聊的事，而不是靠蛮力去解决的问题。不管你最终怎么决定，录音都还在那里，录音才是真正的原始数据，转录稿只是它的一种呈现方式。

## 第二次访谈之前，先把你的转录规则写下来

一旦定下细节程度，就把具体规则固定下来，写成一份简短的文档，放在手边随时查。规则改晚了，就意味着要把已经做完的每一段录音重新过一遍，这种活很容易悄无声息地吃掉你两个星期。

值得提前定下来的几件事：

- 填充词和说到一半改口的话要不要保留，是全部整理干净，还是只在看起来有意义时保留——最后这个选项最容易导致各份访谈之间做法不一致。
- 停顿怎么标记，长停顿和短停顿要不要区分。
- 重叠的话怎么标注，分不清谁先开口时怎么处理。
- 听不清的地方怎么标记，要不要注明听不清的原因。
- 发言人怎么标注，这种标注和你的匿名化方案之间是什么关系。
- 时间戳标在哪里：固定间隔标一次，每次换发言人标一次，还是只标在你预计会引用的段落上。

时间戳值得单独说一说。它能让你论文里引用的话追溯到录音里的具体位置，这正是让你的论证可以被核查的关键——包括答辩委员在内，只要他们能拿到你的数据。转录时顺手加上时间戳几乎不花额外时间。等转录稿都做完了再补，就得拿着秒表把整段录音重新听一遍。不管用什么工具，第一遍就把时间戳标好。

## 知情同意书和伦理审批决定了录音能去哪里

你的知情同意书不是研究开始前走个流程的一张纸。它是一组条件，规定了你现在能对这些录音做什么，通常涵盖三件事：录音怎么存放，谁能听，什么时候销毁。

把录音发给第三方转录服务，本质上是一次披露。你项目之外的某个人或某个系统，现在拿到了受访者声音的一份拷贝。这必须符合受访者当初同意的内容。有时候明显符合，因为同意书里早就写清楚了。有时候明显不符合，因为受访者当初被告知只有研究团队会听这段录音。很多时候同意书写得模糊，这种模糊最好在上传之前就找导师或伦理委员会问清楚，而不是等出了问题再说。

伦理审批往往还会更进一步，规定录音要存在什么设备或机构系统上，存多久。转录稿也要遵守这些规定。由它衍生出来的一切——你的编码文件、引用摘录、写论文时用来粘贴段落的工作文档——都算作数据，都应该放在你获批的存储方案里。一旦深入分析阶段，副本会在笔记本电脑、云盘、发给自己的邮件之间不断增殖，这一点很容易被忽略。

实际操作上，这一点会先于质量和价格的比较，缩小你在工具上的选择范围。一个在你自己设备上处理文件的服务，和一个把文件上传出去的服务，是完全不同的两件事。如果你正在权衡这个问题，值得去看看某个工具具体是 [怎么处理你的文件和数据的](https://sozai.app/zh/security/) ，而不是想当然。如果找不到明确的说法，那本身就是一种答案。

## 匿名化要在转录稿上做

录音要保持原样。你没法通过编辑文字来让一个声音变得匿名，而且你本来也不该去改动自己的原始数据。匿名化处理的对象是转录稿。

具体来说，就是替换掉姓名、地名、单位名称、能指向某个具体人的职务名称，以及那些只要熟悉当时场景的人一看就能认出是谁的细节。要做得前后一致。如果某位同事在一份访谈里被称为“同事A”，那她在所有出现的地方都应该叫“同事A”，整套材料要统一这个规则。前后不一致的匿名化处理比完全不做还糟，因为它看起来像是匿名了，但仔细读的人还是能对上号。

如果你保留了真实身份和替换名称的对应表，一定要和转录稿分开存放，存放条件按伦理审批的要求来，并且自己想清楚为什么要留这份对应表、什么时候销毁它。有些项目确实有理由留着——你可能需要联系受访者做后续访谈，或者把同一个人不同轮次的访谈对上号。有些项目没有这个理由，这时候最安全的对应表就是根本不存在的那一份。关键是要经过深思熟虑地做决定，而不是随手为之。

有一点要提醒：图快的话，查找替换只能抓住明显的姓名，剩下的会漏掉——用过两次的小名、拼错的名字、只有这座城市里某一栋楼才符合的描述。匿名化这一步需要人眼把整份文档过一遍。

## 自动转录真正帮得上忙的地方

自动转录能给你一份初稿。这确实能省下不少时间，如果出于某种原则拒绝使用它，多半意味着要把好几个小时的录音手打出来，却换不来任何方法论上的好处。但它给不了你一份完成稿。

对访谈数据来说，对照录音逐句校对是方法本身的一部分，不是最后可做可不做的收尾工作。你一边听录音，一边看着初稿，改掉错的地方，把机器漏掉、但你的规则要求保留的内容补回去，插入或核对时间戳，做匿名化处理。这个过程比逐字阅读慢，比从头打字快。它还有一个好处：让你熟悉材料，这不是什么附带的小好处。自己动手转录访谈的研究者，进入分析阶段时早就对材料很熟了，校对这一步能帮你把这份熟悉感的一大部分找回来。

如果你想要一份初稿，又不想把文件传到服务器上， [SozAI 这款支持 iOS、Android 和 macOS 的应用](https://sozai.app/zh/download/) 可以为录音和文件生成带发言人标注的转录稿，把访谈转录里机械性的那部分做完，把真正重要的校对环节留给你；关于这一点具体怎么用在 [访谈转录上](https://sozai.app/zh/interview-transcription/) ，可以再往下看。这只是众多选择中的一个，前面提到的存储问题应该先于质量比较，帮你筛掉一部分候选工具。

## 初稿做不到的事

初稿最容易出问题的地方，恰恰是访谈本来就最难处理的地方。抢话会打乱发言人的区分，两个人同时说话，往往会被识别成一个人说了一句语无伦次的话。口音重、说话声音小、咖啡馆或走廊里的背景噪音，还有某个领域特有的专业词汇，都会拉低准确率。发言人标注通常八九不离十，但在边界处不太可靠，尤其是那种插进来的简短插话。

它也给不了你语调和节奏。没有一款自动转录工具能保留停顿的长短，或者标出受访者语气发生变化的那一刻。如果你的分析需要这些，机器初稿只是把文字搭起来的一个框架，仅此而已，你要按这个标准去安排自己的时间。如果同一批访谈材料，同事做的是内容导向的分析，他可能只需要你一小部分的时间就能做完，这不是因为他做得不认真，而是因为他的转录稿在回答一个不同的问题。

花的时间也要比算出来的数字多留一些余量。校对不是把录音正常速度放一遍就完事，而是不断暂停、倒回去、把听不清的那六秒反复听。对一整套访谈做这件事，工作量本来就很大，这很正常。如果想知道整个项目里这些环节怎么拼在一起，可以看看 [一位论文研究者的完整工作流程](https://sozai.app/zh/cases/case-thesis-researcher/) ，从原始文件一路走到可以引用的转录稿。

最后要记住的一点是，转录稿始终是一种呈现方式，你选的每一条规则，都是在决定保留什么、舍弃什么。把这些决定写进你的研究方法章节。答辩委员如果知道你的转录稿为什么长这个样子，会认为这是经过深思熟虑的；不知道的人，只会觉得疑惑。

答案

## Frequently Asked Questions

研究访谈的转录稿需要多详细？

这取决于你的分析要拿它做什么。如果你研究的是受访者说了什么，一份干净的文字转录稿就够了。如果你研究的是他们怎么说的，就需要保留停顿、重叠和犹豫。要在动笔前就决定好，因为规则改晚了，就意味着要把已经转录完的每一段录音重新过一遍。

定性研究可以用自动转录吗？

可以，但只作为初稿。对照录音逐句校对是方法本身的一部分，不是可有可无的收尾工作，而且校对过程也是你熟悉材料的机会。有两个前提：一是你的知情同意和伦理审批要允许把录音传到你要用的地方；二是自动转录会去掉停顿和犹豫，所以更适合研究内容而不是研究互动方式。

把录音交给转录服务，会违反受访者的知情同意吗？

有可能。知情同意通常涵盖录音怎么存放、谁能听、什么时候销毁，把音频发给第三方服务本质上是一次披露，必须符合受访者当初同意的内容。伦理审批往往还会规定存放地点和存放时长。上传前先把这两点核查清楚，有疑问就找导师或伦理委员会解决，不要等出了问题再说。

转录稿的匿名化应该怎么做才靠谱？

匿名化处理的对象是转录稿，不是录音。要一致地替换姓名、地名和其他能识别身份的细节，同一个人在整套材料里都用同一个替代名称。如果保留了真实身份和替代名称的对应表，要单独存放，并想清楚为什么留着它。查找替换会漏掉小名、拼错的名字和一些具体描述，所以最后一定要人工通读一遍。

转录稿要不要保留停顿和填充词？

如果分析关注的是怎么说的，就保留；如果关注的是说了什么，就去掉。为了保险起见把所有内容都转录到最细的程度，通常是不划算的做法：速度慢，转录稿更难读也更难编码，而且大部分细节根本用不上。定下规则后就统一执行。

转录稿需要逐句对照录音检查吗？

对访谈数据来说，需要。自动转录只能给出初稿，校对环节才是纠正错误、核对时间戳、按规则补回遗漏内容的地方，也是你正式进入分析前熟悉材料的机会。这个过程会花不少时间，因为你要不断暂停、重听，而不是从头到尾正常速度听一遍。

![Merey Tleugazin](https://sozai.app/wp-content/themes/sozai/assets/images/merey-tleugazin.webp)

[Merey Tleugazin](https://sozai.app/about/merey/)

SozAI 创始人。正在为全球专业人士打造将语音转为文本的工具。

- [Instagram](https://instagram.com/mereytleugazin)
- [X](https://x.com/mereytleugazin)

## 相关文章

- [7 月 30 1 min ### 换新手机前，怎么保存WhatsApp语音消息](https://sozai.app/zh/save-whatsapp-voice-messages/)
- [7 月 30 1 min ### 语音留言消失前，如何把它保存下来](https://sozai.app/zh/save-a-voicemail/)
- [8 月 2 1 min ### 音频转文字,真的可以做到完全不上传吗?](https://sozai.app/zh/transcribe-audio-without-uploading-it/)

[![SozAI](https://sozai.app/wp-content/themes/sozai/assets/images/appicon.png) SozAI — 免费下载 即时转录音频和视频 获取 App](https://sozai.app/zh/download/)


---
This is the markdown twin of https://sozai.app/zh/interview-transcript-for-research/ — the same content, without the markup.
Published by SozAI (https://sozai.app). Reuse and quotation are allowed with attribution and a link back.
Machine-readable index: https://sozai.app/llms.txt · data API: https://sozai.app/api/
