Перейти к содержимому

Как расшифровать интервью для исследования и не потерять данные

1 min read 1 views Последнее обновление: Авг 2, 2026
A desk with a handheld voice recorder, a printed sheet, a pen and an open laptop showing text

Основные выводы

Прежде чем начинать расшифровку, решите, насколько подробной она должна быть. Если вас интересует, что говорили участники, достаточно чистой, легко читаемой расшифровки. Если важно, как это было сказано, нужно сохранять паузы, наложения речи и оговорки — а автоматическая расшифровка убирает именно это. Перед тем как загружать записи куда-либо, проверьте, что написано в форме согласия и в разрешении этической комиссии о том, где записи могут храниться. Обезличивайте текст расшифровки, а не саму запись, храните таблицу соответствий отдельно и используйте временные метки, чтобы цитаты можно было проверить.

Никто не говорит вам стандарт, потому что единого стандарта нет. Их несколько, и то, какой подходит вам, зависит от того, что вы планируете делать с расшифровками дальше. Это методологическое решение, и его нужно принять раньше, чем выбирать инструмент, а не после.

Если сделать в обратном порядке, цена ошибки реальна. Вы аккуратно расшифровываете шесть интервью, приступаете к анализу — и понимаете, что нужно знать, где участник делал паузу. Теперь придётся заново прослушивать шесть записей другим ухом. Поэтому потратьте час на этот вопрос заранее.

Определите, для чего нужна расшифровка, прежде чем расшифровывать хоть слово

Насколько подробной должна быть расшифровка — вопрос метода, а не аккуратности или усердия. Это следует из вашего подхода к анализу.

Если анализ касается того, что было сказано, чистой расшифровки достаточно. Вам нужны точные слова, привязанные к правильному говорящему. Слова-паразиты, оборванные фразы и короткие паузы можно убрать без потерь, потому что они никогда не попадут в вашу кодировку. Большая часть тематического и содержательного анализа устроена именно так, и чистая расшифровка быстрее готовится, быстрее читается и быстрее кодируется.

Если анализ касается того, как это было сказано, ситуация меняется на обратную. Паузы, наложения речи, оговорки, момент, когда два человека говорят одновременно, три секунды перед ответом, исправление посередине фразы — вот это и есть данные. Расшифровка, из которой это убрано, убрала именно то, что вы изучаете. Это особенно важно применительно к автоматической расшифровке, потому что она хорошо умеет именно сглаживать такие детали. Она даёт связный, легко читаемый текст, а связный легко читаемый текст — это версия с потерями разговора, полного пауз и наложений.

Есть соблазн подстраховаться и расшифровывать всё максимально подробно — раз всегда можно проигнорировать то, что не нужно. Обычно это неверный ход. Подробная расшифровка делает работу медленной, а медленная работа над двадцатью интервью съедает месяцы, которых у вас нет. Кроме того, такие расшифровки труднее читать, а значит, и кодировать. Если вы пока не знаете, важно ли взаимодействие для вашего анализа, — это разговор с научным руководителем, а не задача, которую решают силовым методом. Что бы вы ни выбрали, записи остаются: именно запись — настоящие данные, а расшифровка — только её представление.

Зафиксируйте правила оформления до второго интервью

Определившись с уровнем детализации, закрепите правила оформления и запишите их в короткий документ, который держите под рукой во время работы. Изменить их позже означает заново пройти по всем уже сделанным записям, а это та задача, которая незаметно съедает пару недель.

Что стоит решить заранее:

  • Сохраняются ли слова-паразиты и оборванные фразы, убираются ли они полностью или остаются только там, где кажутся значимыми, — последний вариант чаще всего приводит к несогласованности между интервью.
  • Как отмечаются паузы и различаются ли короткие и длинные паузы.
  • Как обозначается наложение речи и что делать, если непонятно, кто начал говорить первым.
  • Как помечаются неразборчивые фрагменты и указывается ли причина неразборчивости.
  • Как обозначаются говорящие и как эта маркировка соотносится со схемой обезличивания.
  • Где ставятся временные метки: через равные интервалы, при каждой смене говорящего или только там, где вы планируете цитировать.

Временные метки заслуживают отдельного внимания. Они позволяют найти в записи то место, откуда взята цитата в вашей работе, и именно это делает утверждение проверяемым — в том числе для человека, у которого есть доступ к вашим данным, включая экзаменатора. Расставлять их по ходу работы почти ничего не стоит. Добавлять их потом, в готовую расшифровку, означает заново прослушивать всю запись с секундомером в руках. Каким бы инструментом вы ни пользовались, расставляйте метки уже при первом проходе.

Согласие участников и разрешение этической комиссии определяют, куда можно отправлять аудио

Форма согласия — это не формальность, оставшаяся в начале исследования. Это набор условий на то, что вы можете делать с записями сейчас, и обычно она касается трёх вещей: как хранится запись, кто имеет право её слушать и когда она будет удалена.

Отправка аудио в сторонний сервис расшифровки — это раскрытие данных. У кого-то или чего-то за пределами вашего проекта появляется копия голоса участника. Это должно соответствовать тому, на что участник давал согласие. Иногда соответствие очевидно, потому что форма это предусматривала. Иногда — очевидно нет, потому что участнику сказали, что запись услышит только исследовательская группа. Часто формулировка неоднозначна, и эту неоднозначность лучше снять с научным руководителем или этической комиссией до загрузки файлов, а не после.

Разрешение этической комиссии часто идёт дальше и указывает, где могут храниться записи, на каком устройстве или в какой институциональной системе и как долго. Расшифровка наследует эти условия. Как и всё, что из неё сделано: файлы с кодировкой, выдержки с цитатами, рабочий документ, куда вы вставляете фрагменты при написании текста. Всё это данные, и все они должны находиться в том хранилище, которое было согласовано. Легко упустить это из виду, когда вы глубоко в анализе, а копии начинают множиться по ноутбуку, облачному диску и письмам самому себе.

На практике это сужает выбор инструментов ещё до того, как вы начнёте сравнивать их по качеству или цене. Сервис, который обрабатывает файлы на вашем собственном устройстве, — это совсем другая история, чем тот, что загружает их на сервер, и если вы это оцениваете, стоит почитать, как конкретный инструмент обращается с вашими файлами и данными, а не полагаться на предположения. Если ответа на этот вопрос нигде нет прямо, считайте это ответом.

Обезличивание происходит в тексте расшифровки

Сама запись остаётся неизменной. Голос нельзя обезличить, редактируя текст, да и менять первичные данные не стоит в принципе. Обезличивание — это то, что вы делаете с расшифровкой.

Это значит замену имён, названий мест, названий работодателей, должностей, которые указывают на конкретного человека, и мелких деталей, по которым человека узнает кто-то, знакомый с обстановкой. Делайте это последовательно. Если коллега в одном интервью обозначен как [Коллега A], она должна быть [Коллега A] везде, где появляется, и то же правило должно действовать во всём массиве расшифровок. Непоследовательное псевдонимизирование хуже, чем никакое, потому что выглядит как обезличивание, но при внимательном чтении легко раскрывается.

Если вы ведёте таблицу соответствий между реальными именами и заменами, храните её отдельно от расшифровок, на условиях хранения, которые предусмотрены вашим разрешением, и чётко понимайте, зачем вы её храните и когда она будет уничтожена. В некоторых проектах есть веская причина её сохранить: например, может понадобиться повторно связаться с участниками или сопоставить интервью разных этапов. В других — причины нет, и самая безопасная таблица соответствий — та, которой не существует. Главное — принять это решение осознанно.

Одно предупреждение насчёт того, чтобы делать это быстро. Автозамена находит очевидные имена и упускает всё остальное: прозвище, упомянутое дважды, опечатку, описание здания, которое подходит только к одному месту в городе. Обезличивание требует, чтобы человеческий взгляд прошёлся по всему документу.

Где автоматическая расшифровка действительно помогает

Автоматическая расшифровка даёт первый черновик. Это реальная экономия времени, и отказываться от неё из принципа означает, по сути, вручную набирать несколько часов речи без какой-либо методологической выгоды. Чего она не даёт — это готовой расшифровки.

Для интервью проверка черновика по звуку — часть метода, а не необязательная доработка в конце. Вы прослушиваете запись с черновиком перед глазами, исправляете ошибки, восстанавливаете всё, что требуют ваши правила оформления и что машина упустила, вставляете или проверяете временные метки, применяете обезличивание. Это медленнее, чем читать, и быстрее, чем печатать заново. И именно на этом этапе вы по-настоящему знакомитесь с материалом — а это не побочный бонус. Исследователи, которые сами расшифровывают свои интервью, приходят к анализу, уже зная, что в них содержится, и проверочный проход возвращает значительную часть этого знания.

Если нужен черновик без отправки файлов на сервер, приложение SozAI для iOS, Android и macOS расшифровывает записи и файлы с разметкой говорящих, что закрывает механическую часть расшифровки интервью и оставляет вам именно тот проход, который важен; подробнее о том, как это применимо именно к расшифровке интервью. Это один из вариантов среди прочих, и вопрос хранения данных, о котором говорилось выше, должен отсеивать варианты раньше вопроса качества.

Чего первый черновик не сделает за вас

Ожидайте, что черновик будет слабее всего именно там, где интервью труднее всего расшифровывать. Одновременная речь путает разделение по говорящим, и когда два человека говорят одновременно, это часто превращается в одну слегка бессвязную фразу одного человека. Сильный акцент, тихая речь участника, фоновый шум из кафе или коридора и специфическая для вашей области терминология — всё это снижает точность. Разметка говорящих обычно близка к правильной, но ненадёжна на границах, особенно вокруг коротких вставок.

И черновик не даст вам просодии. Ни одна автоматическая расшифровка не сохраняет длительность паузы и не отмечает момент, когда голос участника изменился. Если это нужно для вашего анализа, машинный черновик — просто каркас для слов, не больше, и время нужно рассчитывать соответственно. Коллега, работающий с тем же массивом данных, но с содержательным вопросом, закончит в разы быстрее, и не потому, что работает менее внимательно. Его расшифровка отвечает на другой вопрос.

Закладывайте больше времени, чем подсказывает простая арифметика. Проверочный проход — это не один прогон записи на обычной скорости; это остановки, перематывание назад, повторное прослушивание тех шести секунд, которые не удаётся разобрать. На полном комплекте интервью это существенный объём работы, и это нормально. Если хочется увидеть, как всё это складывается в рамках целого проекта, есть разбор рабочего процесса исследователя, писавшего диссертацию, который показывает путь одного набора записей от файла до цитируемой расшифровки.

Последнее, что стоит запомнить: расшифровка — это представление, и каждое ваше правило оформления — это решение о том, что сохранить, а что потерять. Внесите эти решения в раздел методологии. Экзаменатор, который понимает, почему ваши расшифровки выглядят именно так, прочитает их как обдуманные. Тот, кто не понимает, — задаст вопросы.

Ответы

Frequently Asked Questions

Насколько подробной должна быть расшифровка интервью для исследования?

Зависит от того, что вы делаете с расшифровкой дальше. Если вы изучаете, что говорили участники, достаточно чистой расшифровки слов. Если изучаете, как они это говорили, нужно сохранять паузы, наложения речи и оговорки. Решите это заранее: изменить правила потом означает заново пройти по всем уже расшифрованным записям.

Можно ли использовать автоматическую расшифровку для качественного исследования?

Да, как первый черновик. Проверка по звуку — часть метода, а не необязательная доработка, и именно на этом этапе вы знакомитесь с материалом. Важны два условия: ваше согласие участников и разрешение этической комиссии должны позволять отправлять аудио туда, куда оно отправляется, а автоматическая расшифровка убирает паузы и оговорки, поэтому лучше подходит для анализа содержания, а не взаимодействия.

Нарушает ли отправка записей в сервис расшифровки согласие участников?

Может нарушать. Согласие обычно определяет, как хранится запись, кто может её слушать и когда она удаляется, а отправка аудио в сторонний сервис — это раскрытие данных, которое должно соответствовать тому, на что согласился участник. Разрешение этической комиссии часто дополнительно указывает место и срок хранения. Проверьте оба документа до загрузки, а любую неоднозначность снимайте с научным руководителем или комиссией заранее, а не постфактум.

Как правильно обезличить расшифровку интервью?

Обезличивание делается в тексте расшифровки, а не в самой записи. Заменяйте имена, места и другие идентифицирующие детали последовательно, чтобы один и тот же человек везде получал одну и ту же замену по всему массиву данных. Если ведёте таблицу соответствий между реальными именами и заменами, храните её отдельно от расшифровок и чётко понимайте, зачем она вам нужна. Автозамена упускает прозвища, опечатки и косвенные детали — документ нужно перечитать вручную.

Нужно ли сохранять паузы и слова-паразиты в расшифровке?

Сохраняйте их, если анализ касается того, как это было сказано, и убирайте, если анализ касается того, что было сказано. Расшифровывать всё максимально подробно на всякий случай обычно неверный ход: это медленно, усложняет чтение и кодирование, а большая часть деталей никогда не понадобится. Решите один раз и придерживайтесь этого правила во всём массиве.

Нужно ли сверять всю расшифровку с аудиозаписью?

Для интервью — да. Автоматическая расшифровка даёт первый черновик, а проверочный проход — это момент, когда исправляются ошибки, проверяются временные метки и восстанавливается всё, что требуют ваши правила оформления. Это также этап, на котором вы по-настоящему знакомитесь с материалом перед анализом. Закладывайте на это реальное время: вы будете останавливаться и переслушивать, а не просто прослушивать запись насквозь.

Merey Tleugazin

Основатель SozAI. Создаю инструменты преобразования речи в текст для профессионалов по всему миру.

SozAI
SozAI — Скачать бесплатноТранскрибируйте аудио и видео мгновенно
Скачать