Бесплатный инструмент
Убрать переносы строк и тайм-коды из транскрипта
Уберите из транскрипта переносы строк, тайм-коды, звуковые пометки и слова-паразиты — и получите читаемые абзацы. Вставьте текст, выберите, что чистить, и скопируйте результат.
- Работает в браузере
- Ничего не загружается
- Без регистрации
Список слов-паразитов
По умолчанию в список включены только звуки, которые никогда не несут смысла. Слова вроде «как бы» или «значит» — тоже настоящие слова: добавьте их сами, если хотите убрать. Фразы из нескольких слов тоже работают.
Работает в вашем браузере — текст не загружается. Очиститель не может добавить знаки препинания, которых нет: автосубтитры идут без точек, поэтому проверьте результат перед публикацией.
Сначала нужна расшифровка видео?Получить её по ссылке на YouTube →
Как это работает
Убрать переносы строк и тайм-коды из транскрипта за три шага
Вставьте транскрипт
Из нашего инструмента транскрипта YouTube, панели транскрипта YouTube или файла SRT либо VTT.
Выберите, что чистить
Тайм-коды, разорванные строки, звуковые пометки, слова-паразиты, метки говорящих — каждый пункт включается переключателем.
Скопируйте чистые абзацы
Результат обновляется при смене параметров. Скопируйте его или скачайте файл .txt.
Что убирает очиститель
Транскрипт, скопированный из видеоплеера, сделан для того, чтобы следить за речью, а не читать: тайм-код каждые несколько секунд, перенос строки там, где закончился субтитр, [Music] посреди предложения. Очиститель снимает эти строительные леса и отдаёт абзацы. Любой параметр можно отключить, а результат обновляется по мере набора.
| Параметр | До | После |
|---|---|---|
| Убрать тайм-коды | [02:14] so the first thing | So the first thing |
| Убрать тайм-коды (файл субтитров) | 12 / 00:00:41,200 --> 00:00:43,900 / text | Text |
| Склеить разорванные строки | the brain keeps what it uses | The brain keeps what it uses |
| Убрать звуковые пометки | it fades [Applause] fast | It fades fast |
| Убрать слова-паразиты | So, um, I think, uh, yes | So, I think, yes |
| Убрать метки говорящих | Speaker 1: Hello | Hello |
Какие форматы он понимает
- Наш транскрипт YouTube — копия с
[мм:сс] Speaker A:перед каждым сегментом. Сегменты одного говорящего склеиваются, а метка говорящего пишется один раз на абзац. - Собственная панель транскрипта YouTube — время в одной строке, слова в следующей. Строки со временем отбрасываются, включая речевую форму, которая есть в некоторых копиях («1 минута, 5 секунд»).
- Файлы субтитров SRT, WebVTT и SBV — номера реплик, строки с таймингом, заголовки VTT, заметки и встроенные теги убираются; голосовой тег VTT становится меткой говорящего; повторяющаяся строка в начале каждой реплики автосубтитров удаляется.
- Заметки со встреч, где имя и время стоят в отдельной строке («Speaker 1 0:03»), превращаются в «Speaker 1:».
Убираются только те тайм-коды, что выглядят как тайм-коды: в начале строки, в отдельной строке или в скобках. «Встречаемся в 10:30» посреди предложения остаётся как есть.
Как пересобираются абзацы
Если текст пришёл из плеера, каждый перенос строки считается концом субтитра, а не абзаца, поэтому сначала строки склеиваются. Слово, разорванное дефисом между двумя строками, собирается обратно. Затем новый абзац начинается каждые 3, 4, 5, 6 или 8 предложений (по умолчанию 4) и всегда — при смене говорящего. Текст, который вы набрали сами, сохраняет свои абзацы, разделённые пустой строкой.
В автосубтитрах обычно нет точек вообще, поэтому считать предложения нечего. Когда в тексте в среднем больше 60 слов на предложение, очиститель режет абзацы по длине — примерно по 20 слов на каждое запрошенное предложение — и сообщает об этом.
«Исправить пробелы и заглавные» убирает двойные пробелы и пробелы перед запятыми и точками, добавляет недостающий пробел после запятой и делает заглавной первую букву каждого предложения. Сокращения вроде «Dr.» и инициалы вроде «U.S.A.» предложение не заканчивают, а слова вроде «iPhone» сохраняют первую букву.
Слова-паразиты — аккуратно
Списки по умолчанию содержат только звуки-запинки — «um», «uh», «erm» в английском, «э», «эм» в русском, «äh», «ähm» в немецком — для десяти языков: английского, русского, украинского, испанского, португальского, французского, немецкого, итальянского, польского и нидерландского. Список выбирается по языку страницы. Слова вроде «like», «you know» или «o sea» намеренно не включены: это ещё и обычные слова, и вслепую убирать их — значит менять смысл. Если хотите убрать их, добавьте их в список сами; работают и фразы из нескольких слов, а ваш список запоминается в этом браузере.
Честные ограничения
Очиститель приводит текст в порядок, но не понимает его. Он не может добавить знаки препинания, которых в источнике никогда не было, не исправит неверно услышанные слова, а строку, начинающуюся с заглавного слова и двоеточия («Note: …»), может принять за метку говорящего — поэтому этот параметр по умолчанию выключен. Прочитайте результат, прежде чем публиковать. Всё выполняется в вашем браузере; текст не загружается и не хранится.
Ответы
Очистка транскрипта — частые вопросы
Как убрать переносы строк из транскрипта?
Вставьте текст и оставьте включённым «Склеить разорванные строки». Строки, оборванные посреди предложения, склеиваются в абзацы, слова, разорванные дефисом, собираются обратно, а новые абзацы начинаются каждые несколько предложений или при смене говорящего.
Как убрать тайм-коды из транскрипта YouTube?
Вставьте его с включённым «Убрать тайм-коды». Работают оба формата: панель транскрипта YouTube со временем в отдельной строке и формат [мм:сс], который копирует наш инструмент транскрипта YouTube. Время посреди предложения остаётся нетронутым.
Можно ли превратить файл SRT или VTT в простой текст?
Да. Вставьте его или откройте файл: номера реплик, строки с таймингом, заголовки VTT и теги форматирования удаляются, повторяющиеся строки автосубтитров YouTube отбрасываются, а текст склеивается в абзацы.
Какие слова-паразиты убираются?
Только звуки-запинки, например um, uh и erm в английском, из встроенных списков для десяти языков. Слов вроде «like» или «you know» в списке нет, потому что это ещё и обычные слова. Список можно редактировать и добавлять в него любые слова и фразы.
Почему абзацы разрезаны в странных местах?
Скорее всего, в тексте нет знаков препинания между предложениями — это типично для автосубтитров. Без точек считать предложения нечего, поэтому абзацы режутся по длине. Выберите «Оставить абзацы как есть», чтобы отключить это.
Добавит ли он недостающую пунктуацию?
Нет. Он исправляет пробелы и делает заглавными начала предложений, но не может придумать точки и запятые, которых никогда не было. Для текста с нормальной пунктуацией расшифруйте саму аудиозапись, а не чистите автосубтитры.
Мой текст загружается?
Нет. Очистка выполняется в вашем браузере, текст никуда не отправляется и не сохраняется. На этом устройстве запоминаются только выбранные параметры и ваши списки слов-паразитов.
Нужна полная расшифровка?
Загрузите аудио или вставьте ссылку на YouTube и получите полную AI-расшифровку с метками спикеров, таймкодами и сводками.
Бесплатно на iOS и Android. Без регистрации.
Бесплатные инструменты
Другие бесплатные инструменты
YouTube Transcript Generator · SozAI vs Other Tools · Alternatives to Popular Apps