Как бесплатно и быстро транскрибировать аудио и видео в текст с помощью сервисов и ChatGPT для удобной обработки информации.
Ask about this video. Answers come from its transcript only — with the timestamp, so you can check them.
Generated from the transcript and can be wrong — check the timestamp.
Key Takeaways
- Транскрибация бесплатна, но ограничена по времени (15 минут на файл).
- Разделение видео на части и экспорт аудио ускоряют процесс.
- Режим инкогнито помогает обойти ограничения бесплатного сервиса.
- ChatGPT эффективно улучшает качество и структуру транскрибированного текста.
- Использование нескольких браузеров и окон позволяет параллельно обрабатывать файлы.
What the video covers
- Объяснение процесса транскрибации аудио и видео в текст на примере длинного вебинара.
- Использование трёх инструментов: сервис anytotext.ru, видеоредактор Ctas Studio и ChatGPT.
- Разделение длинного видео на части по 15 минут из-за ограничений бесплатного сервиса транскрибации.
- Экспорт аудио из видео для ускорения процесса транскрибации.
- Советы по обходу лимитов бесплатного сервиса через режим инкогнито браузера и использование нескольких окон.
- Настройка языка транскрибации и опция автоопределения спикеров.
- Обработка полученного текста с помощью ChatGPT для улучшения читабельности и структурирования.
- Пример использования ChatGPT для переписывания текста с сохранением сути и логическим делением на блоки.
- Рекомендации по сохранению и объединению транскрибированных частей в один файл для удобства работы.
- Общее впечатление о качестве транскрибации и практические советы по оптимизации рабочего процесса.
Full Transcript — Download SRT & Markdown
Speaker A
Как быстро и бесплатно выполнить преобразование аудио или видео в текст и чем чат GPT может помочь при дальнейшей обработке полученной информации? Давайте [музыка] разбираться. Задача для транскрибации, а именно так называется преобразование аудио или видео в текст, может быть множество. Я же покажу процесс на примере задачи, когда необходимо сделать текстовую версию длинного вебинара либо разбить его на какие-то тематические статьи. Использовать я буду три инструмента: это сервис Text, видеоредактор Ctas Studio и Chat GPT. Итак, у меня есть длинный вебинар под названием "Итоги года 2024", который я недавно проводил и хотел бы преобразовать его в текст для дальнейшей работы с ним. Но перед тем как его транскрибировать, его нужно порезать на несколько частей по 15 минут. Почему именно по 15 минут? Всё дело в том, что сервис anytotext.ru позволяет бесплатно транскрибировать файлы продолжительностью только 15 минут. Именно поэтому мне поможет программа Cia Studio. Я в ней работаю при обработке видеоуроков, и она мне просто привычнее. Вы же можете использовать любой видео- или аудиоредактор. Сохраняем аудиофайл по 15 минут. Как это делаю я? Ну, во-первых, [музыка] импортируем необходимый длинный файл. Далее на timeline выбираю промежуток. Мне нужно не более 15 минут. Пускай это будет вот так. А здесь есть вот такая кнопочка "Разделить", "Сплит". Всё, делим файл. И теперь я его вот так вот в начало. Опять же, это мой способ. Вы, если работаете в другом редакторе, можете это сделать по-другому. А кстати, чтобы ускорить процесс, я буду сейчас... Ладно, смотрите. Далее я убираю все вот эти дорожки, которые сверху, и последовательно буду сохранять каждую из дорожек. Но я не буду сохранять в формате видео, почему? Потому что мне нужен только текст, чтобы быстрее выполнить преобразование и вообще сохранение в эти отдельные файлы. Поэтому я буду использовать такую функцию. Здесь есть вот Share, Export Audio Only — экспортировать только аудио. Всё, нажимаю. Допустим, это у меня первый файл, формат m4a. У меня, как бы, он поддерживается. Думаю, что тот же MP3 также сервисом поддерживается. Сохраняем. Видите, процесс довольно быстро проходит. Если бы я сохранял видео, это было бы намного дольше. Можно сделать либо вот так, как делаю я, либо в принципе можно было сохранить отдельно аудиодорожку этого вебинара и уже аудиодорожку порезать на разные части. У меня, кстати, на канале есть одно видео, где я рассказываю о том, как автоматически разрезать на нужную вам длину какой-то длинный файл. Можно воспользоваться вот таким способом: туда закинуть этот длинный аудиофайл и автоматически разрезать его на части. Ну, мне на данный момент проще сделать вот так. Теперь этот скрываю, этот открываю, то есть вторая дорожка два. Ну, для примера. Давайте все, я их не буду сохранять, сохраню штуки и третий. Далее м. Если вы первый раз зайдёте на этот сервис, вы сможете транскрибировать файл пятнадцати минут, но потом он вам скажет, что необходимо зарегистрироваться. Вы бесплатные минуты использовали. Вот у меня показывает ваш баланс 6 минут. То есть я, получается, какой-то девятины файл уже транскрибировал, у вас бесплатно осталось 6 минут. А если мы закинем этот файл сюда, допустим первый, вот 14:59, он говорит, что 6 минут у вас бесплатно, далее оплатите 45 рублей, чтобы полную это файл... Всё, это сделаем бесплатно. Как обойти эту историю? Просто открываем в режиме инкогнито браузер и открываем этот же сайт. То есть в данном случае сайт думает, что мы первый раз на него вошли, поэтому идём, загружаем файл. Первый идёт загрузка. Далее выбираем язык транскрибации. Ну, если вы знаете, что у вас там только русский, в принципе, это будет проще самому сервису преобразовать. Поэтому выбираем у меня русский, субтитры, автоопределение спикеров. Я честно говоря вот эти истории не тестировал, но здесь возможно, если у вас какой-то диалог, берёте интервью, допустим, что-то типа того, указать спикеров, он будет по голосу пытаться различать, когда кто говорит. И также вам в транскрибации указывать разных спикеров. В данном случае мне это не надо, поэтому я просто указываю язык транскрибации русский, применить, всё преобразовать. Смотрите, вот у нас пошёл процесс преобразования, и, ну, потребуется определённое время. И чтобы ускорить эту процедуру, мы можем сделать следующим образом: либо установить браузер какой-то ещё один. У меня вот, допустим, два браузера. Можно, наверное, даже какую-то портативную версию браузера использовать. Ну, в общем, здесь суть в чём: также открываем в режиме инкогнито и, к примеру, сюда уже закидываем второй файл. Также у нас есть встроенный Microsoft H, так отсюда нет, отсюда он не открывает. Ну, его запускаем и также в нём открываем окно In Private, то есть тоже режим инкогнито. Сюда третий файл загружаем, аналогично дожидаемся завершения процесса. Вот, транскрибация закончена. Примерно около 15 минут бесплатно. В принципе, если открыть несколько окон, то можно довольно быстро всё это дело преобразовать. Опять же, вот этот сервис очень хорошо преобразует, то есть сколько я изучал, минимум ошибок он допускает в словах. Да, где-то изредка случаются, но по минималке. Пря даже вот интересно разбивает на абзацы и так далее. Однако что мы можем сделать с этим далее? Так как у нас состоит из разных частей, можем что сделать? Допустим, скопировать всю эту первую часть и создать под каждый файл свой документ, чтобы, ну, так скажем, тупо сохранить результат. Допустим, у вас, ну, не знаю, там 10-15 файлов запустили на обработку. Ну, не знаю, занимаетесь пока какими-то другими делами. Через 15 минут зашли, всё это перекинули, новые файлы закинули. Вот второй файл тоже готов. Все их также кусками соберём, а потом когда всё обработали, создать какой-нибудь общий файл, куда все эти части добавить, и в итоге у вас получится один файл — полная транскрибация какого-то вебинара, видеоурока, всего, что захотите. Далее смотрите, чтобы нам, если мы сейчас загрузим сюда следующий файл, то он опять же скажет, что оп, ребята, у вас ограничения и так далее. Поэтому чтобы заново загрузить, мы просто закрываем это окно инкогнито и открываем новое. Обязательно закрываем и открываем, так как если мы просто откроем ещё одно инкогнито окно, он будет считать, что это всё равно один сеанс и также не даст нам возможность преобразовать. Вот что делаем далее. В моей ситуации текст получился не очень читабельный, так как здесь могут присутствовать слова-паразиты, там общение с аудиторией, и сами предложения выглядят немного некорректно. Ну вот, допустим, кстати да, что у меня там дальше? Ладно, ну то есть такие слова, которые я использую, ну в прямом эфире и при общении с аудиторией, где-то мысли вслух, скажем так, не очень читаемо. Поэтому что мы можем сделать дальше? Выделяем текст, и его необходимо преобразовать как бы в более читабельный формат. А вот здесь как раз-таки нам и поможет чат GPT. Лично я пользуюсь вот этой версией сайта Perplexity. Сюда вставляем данный текст, его в кавычки оформляем. Честно говоря, не очень уверен, что именно в кавычки нужно, но по крайней мере я так всегда делаю. Мне кажется, это логично, чтобы он понимал, с каким текстом ему нужно работать. И здесь задаём собственно команду: перепиши данный текст в более читабельный вид с сохранением сути повествования. И давайте посмотрим, что он нам предложит. Обучение, много администрированию, так, дата начала, различные преимущества. То есть, ну, здесь вот я рассказывал также, что 17 января стартует КОСА 11.11. Да, но он тут почему-то открыто на восьмой, девятый, десятый поток. Ну, в общем, в принципе неплохо, нет таких каких-то особых нарушений. Он, ну, структурирует даже, как вы видите, делит на определённые абзацы, тематические блоки, так скажем. То есть он логически понимает, о чём там идёт речь, и чтобы нам было удобнее изучать эту информацию, вот таким образом можем всё это дело разделить, и намного комфортнее уже всё это дело читается. Ну вот и всё, с задачей мы справились. Также, допустим, у меня есть какой-то длинный вебинар, который я хочу посмотреть, а также сделать в нём определённые заметки, чтобы это не делать вручную. Я его транскрибирую, запись у меня открыта, его транскрибирования версия, и я просто оттуда копирую какие-то интересные мысли, заметки. То есть так тоже намного проще документировать и делать заметки по как...
Speaker A
множество Я же покажу процесс на примере задачи Когда необходимо сделать текстовую версию длинного вебинара либо разбить его на какие-то тематические статьи использовать я буду три инструмента это сервис тек видеоредактор ctas Studio и Chat gpt итак у меня есть длинный вебинар под
Speaker A
названием итоги года 2024 который я недавно проводил и хотел бы преобразовать его текст для дальнейшей работы с ним но перед тем как его транскрибировать его нужно порезать на несколько частей по 15 минут Почему именно по 15 минут Всё дело в том что сервис any to
Speaker A
text.ru позволяет бесплатно транскрибировать файлы продолжительностью только 15 минут Именно поэтому мне поможет программа cia Studio Я в ней работаю при обработке видеоуроков и она мне просто привычнее вы же можете использовать любой видео или аудиоредактор сохраняем аудиофайл по 15
Speaker A
минут как это делаю я ну во-первых [музыка] импортируем необходимый длинный файл далее на timeline выбираю промежуток Мне нужно не более 15 минут Пускай это будет вот так а здесь есть вот такая кнопочка разделить Сплит всё делим файл И теперь я его вот
Speaker A
так вот в начало опять же Это мой способ Вы если работаете в другом редакторе можете это сделать по-другому а кстати чтобы ускорить процесс я буду сейчас Ладно смотрите далее я убираю все вот эти дорожки которые сверху и последовательно
Speaker A
буду сохранять Каждую из дорожек но я не буду сохранять в формате видео почему потому что ну мне нужен только текст чтобы быстрее выполнило преобразование и вообще сохранение в эти отдельные файлы Поэтому я буду использую такую функцию здесь есть вот Share exp Audio Only
Speaker A
экспортировать Только аудио всё нажимаю допустим это у меня первый файл формат m4a у меня и как бы он поддерживается думаю что тот же MP3 также сервисом поддерживается сохраняем видите процесс довольно быстро проходит Если бы я сохранял видео это
Speaker A
было бы намного дольше можно сделать либо вот так как делаю я либо в принципе можно было сохранить отдельно аудиодорожку этого вебинара и уже аудиодорожку порезать на разные части У меня кстати на канале есть одно видео где я рассказываю о том как автоматически
Speaker A
разрезать на нужную вам длину какой-то длинный файл можно воспользоваться вот таким способом туда закинуть этот длинный аудиофайл и автоматически разрезать его на части Ну мне на данный момент проще сделать вот так теперь этот скрываю этот открываю то есть вторая
Speaker A
дорожка два Ну для примера Давайте все я их не буду сохранять сохраню штуки и третий далее м Если вы первый раз зайдёте на этот сервис вы сможете транскрибировать файл пятнадцати нут но потом он вам скажет что необходимо зарегистрироваться вы
Speaker A
бесплатные минуты использовали вот у меня показывает ваш баланс 6 минут То есть я получается какой-то девятины файл уже транскрибировать у вас бесплатно осталось 6 минут а если мы закинем этот файл сюда допустим первый вот 1459 он говорит что 6 минут у вас бесплатно
Speaker A
далее оплатите 45 руб чтобы полною это Фато всё это сделаем бесплатно Как обойти эту историю просто открываем в режиме инкогнито браузер и открываем этот же сайт то есть в данном случае сайт думает что мы первый раз на него вошли поэтому идём
Speaker A
загружаем файл первый идёт загрузка далее выбрать язык транскрибации Ну если вы знаете что у вас там только русский в принципе это будет проще самому сервису преобразовать поэтому выбираем у меня русский субтитры автоопределение спикеров Я честно говоря вот эти истории
Speaker A
не тестировал но здесь Возможно если у вас какой-то диалог берте интервю допустим что-то типа того указать спикеров он будет по голосу пытаться различать когда Кто говорит И также вам в транскрибации указывать разных спикеров в данном случае мне это не надо поэтому
Speaker A
я просто указываю язык транскрибации русский применить все преобразовать смотрите вот у нас пошёл процесс преобразования и ну потребуется определённое время и чтобы ускорить эту процедуру мы можем сделать следующим образом либо установить браузер какой-то ещё один у меня вот допустим два
Speaker A
браузера Можно наверное даже какую-то портативную версию браузера использовать Ну в общем здесь Суть в чём также открываем в режиме инкогнито и к примеру сюда уже закидываем второй файл также у нас есть встроенный Microsoft H так отсюда нет отсюда Он не открывает
Speaker A
Ну его запускаем и также в нём открываем окно in Private то есть тоже режим инкогнито сюда третий файл загружаем аналогично дожидаемся завершения процесса вот транскрибация закончена примерно около 15 минут бесплатно в принципе если открыть несколько окон то можно довольно
Speaker A
быстро всё это дело преобразовать опять же вот этот сервис очень хорошо преобразует то есть сколько Я изучал минимум ошибок он допускает в словах Да где-то изредко случаются но по минималка пря даже вот интересно разбивает на абзацы и так далее Однако
Speaker A
что мы можем сделать с этим далее так как у нас состоит из разных частей можем Что сделать допустим скопировать всю эту первую часть и создать Под каждый файл свой документ чтобы ну так скажем тупо сохранить результат допустим у вас Ну не знаю там
Speaker A
10-15 файлов запустили на обработку Ну не знаю занимаетесь пока какими-то другими делами Через 15 минут зашли всё это перекинули новые файлы закинули вот Второй файл тоже готов все их также кусками соберём А потом когда всё обработали создать какой-нибудь общий файл куда все
Speaker A
эти части добавить и в итоге у вас получится один файл полная транскрибация какого-то вебинара видеоурока всего что захотите далее смотрите чтобы нам если мы сейчас загрузим сюда следующий файл то он опять же скажет что оп ребята у вас
Speaker A
ограничения и так далее Поэтому чтобы заново загрузить мы просто закрываем это окно инкогнито и открываем новое обязательно закрываем и открываем Так как если мы просто откроем ещё одно инкогнито окно он будет считать что это всё равно один сеанс и также не даст нам
Speaker A
возможность преобразовать вот что делаем далее В моей ситуации текст получился не очень читабельный так как здесь могут присутствовать слова паразиты там общение с аудиторией и сами предложения выглядят немного некорректно Ну вот допустим Кстати да что у меня там дальше
Speaker A
ладно ну то есть такие слова которые я использую Ну в прямом эфире и при общении с аудиторией где-то мысли вслух скажем так не очень читаемо поэтому что мы можем сделать дальше выделяем текст и его необходимо преобразовать как бы в более читабельный формат А вот
Speaker A
здесь как раз-таки нам и поможет чат gpt Лично я пользуюсь вот этой версией сайт perplexity сюда вставляем данный текст его в кавычки оформляем честно говоря не очень уверен что именно в кавычки нужно нуно по крайней мере я так всегда делаю Мне
Speaker A
кажется это логически чтобы он понимал С каким текстом ему нужно работать и здесь задаём собственно команду перепиши данный текст в более читабельный вид с с сохранением сути повествования и Давайте посмотрим что он нам предложит обучение много администрированию так дата
Speaker A
начала различные преимущества то есть ну здесь вот я рассказывал также что 17 января стартует коса 11 11 Да но он тут почему-то открыто на восьмой девятый десятый поток ну В общем в принципе неплохо нет таких каких-то особых нарушений
Speaker A
он Ну структурирует даже как вы видите делит на определённые абзацы тематические блоки так скажем То есть он логически понимает О чём там идёт речь и чтобы нам было удобнее изучать эту информацию вот таким образом Можем всё это дело разделить и намного
Speaker A
комфортнее уже всё это дело читается Ну вот и всё с задачей мы справились также допустим у меня есть какой-то длинный вебинар который я хочу посмотреть а также сделать в нём определённые заметки чтобы это не делать вручную я его
Speaker A
транскрибируемая запись у меня открыт его транскрибирования версия и я просто оттуда копирую какие-то интересные мысли заметки то есть Так тоже намного проще документировать и делать заметки по каким-то материалам Ну и напоследок давайте рассмотрим в каких ситуациях ещё может понадобиться транскрибация аудио
Speaker A
или видео в текстовый формат доступность текстовые версии аудио или видео делают контент доступным для людей с ограниченными возможностями слуха удобство некоторые люди не любят смотреть видео так как у них есть какой-то конкретный запрос и им достаточно быстро пробежаться по тексту
Speaker A
либо вообще привыкли изучать информацию именно через текст SEO оптимизация текстовое содержание помогает улучшить индексацию видео в поисковых системах поэтому на сайте вместо видео желательно публиковать его текстовую версию Ну собственно аналогичным образом поступаю и я анализ текстовые расшифровки облегчают анализ информации и создание
Speaker A
каких-то заметок конспектирование Можно также записать какой-то диалог с Человеком или допустим занятие в аудитории И преобразовать его в текстовый формат Ну а на этом У меня всё спасибо за внимание и до новых встреч а
Topics:транскрибацияаудио в текствидео в текстбесплатная транскрибацияChatGPTобработка текставебинарредактирование видеоanytotext.ruCtas Studio











