Главное
Перематывать запись на слух — медленно: чтобы понять, где вы находитесь, приходится всё время вслушиваться. Транскрипт с таймкодами превращает два часа аудио в примерно семьдесят страниц текста, которые можно найти поиском за пару секунд и сразу перейти к нужному месту. Метки говорящих помогают, когда вы помните, кто это сказал, но не помните когда. Краткое содержание с решениями и задачами часто отвечает на вопрос ещё до того, как вы снова открыли запись. А главный способ избежать этой проблемы — называть время вслух, когда на встрече звучит что-то важное, прямо в момент встречи.
Кто-то на этой встрече что-то сказал. Вы примерно помните, о чём шла речь, может быть, даже кто это сказал, и у вас сильное чувство, что это важно именно сейчас. Чего у вас нет — это отметки времени. Запись длится два часа, встреча была вчера или на прошлой неделе, а единственный инструмент перед глазами — это шкала перемотки.
Первое желание — потянуть за ползунок и слушать. Это желание ошибочно достаточно часто, чтобы объяснить, почему, и что делать вместо этого.
Перемотка — это бинарный поиск на слух
Перемотка длинной записи — это бинарный поиск, который вы выполняете ушами. Вы прыгаете примерно в середину, слушаете несколько секунд, решаете, находитесь ли вы до или после нужного момента, и прыгаете снова. Каждая такая попытка отнимает несколько секунд прослушивания только для того, чтобы понять, где вы вообще находитесь, — а ведь ещё нужно оценить, подходит ли содержание. За два часа записи это выливается в десяток и более попыток, причём каждая следующая медленнее предыдущей: отрезки становятся короче, а вот время на прослушивание — нет.
Дело не в том, что перемотка вообще не работает. На двадцатиминутной записи всё нормально. А вот на двухчасовой, с шестью-восемью разными темами и парой отступлений в сторону, это превращается в десять-пятнадцать минут угадывания ради цитаты, которую можно было бы найти за секунды, если бы она существовала в виде текста.
Превращаем аудио в текст, который можно искать
Два часа речи — это примерно восемнадцать тысяч слов, что-то около семидесяти страниц. Поиск фразы в семидесяти страницах текста занимает секунды — точно так же, как поиск в любом другом документе. В этом и весь фокус: перестать относиться к записи как к аудио, которое нужно прослушать целиком, и начать относиться к ней как к тексту, в котором можно искать.
Возможным это делает транскрипт с таймкодами. У каждой строки текста есть привязка к времени, так что, найдя нужную фразу, вы просто смотрите на цифру рядом с ней и переходите прямо к этому моменту в записи. Никакого нащупывания места на слух — вы попадаете туда напрямую. Инструмент для перевода аудио в текст — это та самая инфраструктура, без которой всё остальное в этой статье не имело бы смысла: без транскрипта всё сводится к той же перемотке.
Метки говорящих и решения сужают поиск ещё сильнее
Иногда вы помните, кто сказал нужную фразу, но не помните когда. Здесь на помощь приходят метки говорящих. Вместо того чтобы искать фразу, которую вы, возможно, помните не совсем точно, по всему транскрипту, можно просматривать только строки одного конкретного человека — по порядку. Область поиска меньше, а меньшая область поиска — это быстрее.
Часто точная цитата вам вообще не нужна. В половине случаев причина, по которой вы копаетесь в записи, — это принятое решение или назначенная задача, а не точные слова, которыми это было сформулировано. Краткое содержание, где решения и задачи перечислены отдельно, может само ответить на вопрос — без обращения к аудио или транскрипту. Именно здесь приложение, которое создаёт транскрипты с метками говорящих и краткое содержание с прикреплёнными решениями, — например, приложение для расшифровки записей, — становится по-настоящему самым быстрым путём от вопроса к ответу. Это один из вариантов среди описанных здесь, причём именно тот, который убирает необходимость искать вовсе, а не просто ускоряет поиск.
Ускоренное воспроизведение приближает вас к цели, но не доводит до неё
Воспроизведение записи на скорости в полтора-два раза — рабочая техника, и большинство плееров поддерживают её без дополнительных настроек. Это разумный первый шаг, когда у вас нет транскрипта и нужно быстро найти нужный отрезок. Прогоняете запись на ускоренной скорости, слушая тему или голос, и снижаете скорость, когда чувствуете, что приближаетесь к нужному месту.
Ограничение в том, что так вы находите отрезок, а не конкретную фразу. Ускоренное аудио неплохо помогает понять, что вы попали в нужный кусок разговора. Но оно хуже подходит для того, чтобы уловить точную реплику, особенно если два человека говорили одновременно или запись изначально была не самой чистой. Если во время встречи вы отметили приблизительное время, а теперь нужно понять, куда это время попадает после того, как вы полистали половину файла на ускоренной скорости, конвертер таймкодов сделает эти вычисления за вас.
Что не спасёт плохую запись
Все три описанных способа работают только тогда, когда сама запись пригодна для использования, а качество записи определяет, насколько хорошо сработает любой из них. Телефон, оставленный посреди стола, за которым разговаривают шесть человек, даёт звук, который никакой транскрипт, даже самый качественный, не спасёт полностью. Одновременная речь — это действительно сложный случай: когда два человека говорят разом, транскрипту приходится угадывать, кто из них произнёс какие слова, и иногда он угадывает неверно. Метки говорящих в тех же условиях становятся менее надёжными по той же причине.
Это не повод отказываться от расшифровки записи низкого качества. Транскрипт с несколькими неточными строками всё равно ищется в разы быстрее, чем два часа аудио без какого-либо текста. Но это повод ожидать пробелов именно в тех частях встречи, которые были самыми громкими и хаотичными, — а это часто именно те моменты, которые вам больше всего нужны.
Привычка, которая избавит от этой проблемы в следующий раз
Всё вышеперечисленное не понадобится, если решить проблему в момент её появления. Когда прозвучало что-то важное, назовите время вслух или запишите его. Вот и всё. Десять секунд во время встречи, потраченные на то, чтобы отметить время или попросить кого-то это сделать, экономят потом двадцать минут перемотки, поиска или угадывания.
Это работает независимо от того, будете ли вы вообще расшифровывать запись. Отметка времени, набросанная в блокноте, — этого достаточно, чтобы сразу перейти к нужному моменту в любом плеере, без всякого поиска. Это почти ничего не стоит в моменте, и это единственный способ из перечисленных, который устраняет проблему, а не решает её постфактум.

