Безкоштовний інструмент
Прибрати переноси рядків і тайм-коди з транскрипту
Приберіть із транскрипту переноси рядків, тайм-коди, звукові позначки та слова-паразити — і отримайте читабельні абзаци. Вставте текст, виберіть, що чистити, і скопіюйте результат.
- Працює у вашому браузері
- Файли нікуди не завантажуються
- Без реєстрації
Список слів-паразитів
За замовчуванням у списку лише звуки, що ніколи не несуть значення. Слова на кшталт «like» чи «you know» також справжні слова — додайте їх самі, якщо хочете їх прибрати. Фрази з кількох слів теж працюють.
Працює у вашому браузері — текст не завантажується. Очищувач не може додати розділові знаки, яких немає: автоматичні субтитри йдуть без крапок, тож перевірте результат, перш ніж його публікувати.
Спершу потрібна транскрипція відео?Отримати її за посиланням на YouTube →
Як це працює
Прибрати переноси рядків і тайм-коди з транскрипту за три кроки
Вставте транскрипт
З нашого інструменту транскрипту YouTube, панелі транскрипту YouTube або файлу SRT чи VTT.
Виберіть, що чистити
Тайм-коди, розірвані рядки, звукові позначки, слова-паразити, позначки мовців — кожен пункт вмикається перемикачем.
Скопіюйте чисті абзаци
Результат оновлюється під час зміни параметрів. Скопіюйте його або завантажте файл .txt.
Що прибирає очищувач
Транскрипт, скопійований із відеоплеєра, зроблений для того, щоб стежити за мовою, а не читати: тайм-код кожні кілька секунд, перенос рядка там, де закінчився субтитр, [Music] посеред речення. Очищувач знімає ці будівельні риштування й віддає абзаци. Будь-який параметр можна вимкнути, а результат оновлюється в міру набору.
| Параметр | До | Після |
|---|---|---|
| Прибрати тайм-коди | [02:14] so the first thing | So the first thing |
| Прибрати тайм-коди (файл субтитрів) | 12 / 00:00:41,200 --> 00:00:43,900 / text | Text |
| Склеїти розірвані рядки | the brain keeps what it uses | The brain keeps what it uses |
| Прибрати звукові позначки | it fades [Applause] fast | It fades fast |
| Прибрати слова-паразити | So, um, I think, uh, yes | So, I think, yes |
| Прибрати позначки мовців | Speaker 1: Hello | Hello |
Які формати він розуміє
- Наш транскрипт YouTube — копія з
[хх:сс] Speaker A:перед кожним сегментом. Сегменти одного мовця склеюються, а позначка мовця пишеться один раз на абзац. - Власна панель транскрипту YouTube — час в одному рядку, слова в наступному. Рядки з часом відкидаються, зокрема мовну форму, яку мають деякі копії («1 хвилина, 5 секунд»).
- Файли субтитрів SRT, WebVTT і SBV — номери реплік, рядки з таймінгом, заголовки VTT, нотатки та вбудовані теги прибираються; голосовий тег VTT стає позначкою мовця; повторюваний рядок на початку кожної репліки автосубтитрів видаляється.
- Нотатки зі зустрічей, де ім’я й час стоять в окремому рядку («Speaker 1 0:03»), перетворюються на «Speaker 1:».
Прибираються лише ті тайм-коди, що виглядають як тайм-коди: на початку рядка, в окремому рядку або в дужках. «Зустрічаємося о 10:30» посеред речення лишається як є.
Як перебудовуються абзаци
Якщо текст прийшов із плеєра, кожен перенос рядка вважається кінцем субтитру, а не абзацу, тому спершу рядки склеюються. Слово, розірване дефісом між двома рядками, збирається назад. Потім новий абзац починається кожні 3, 4, 5, 6 або 8 речень (за замовчуванням 4) і завжди — під час зміни мовця. Текст, який ви набрали самі, зберігає свої абзаци, розділені порожнім рядком.
В автосубтитрах зазвичай немає крапок узагалі, тож рахувати речення нічого. Коли в тексті в середньому понад 60 слів на речення, очищувач ріже абзаци за довжиною — приблизно по 20 слів на кожне запитане речення — і повідомляє про це.
«Виправити пробіли та великі літери» прибирає подвійні пробіли та пробіли перед комами й крапками, додає відсутній пробіл після коми й робить великою першу літеру кожного речення. Скорочення на кшталт «Dr.» та ініціали на кшталт «U.S.A.» речення не закінчують, а слова на кшталт «iPhone» зберігають першу літеру.
Слова-паразити — обережно
Списки за замовчуванням містять лише звуки-запинки — «um», «uh», «erm» в англійській, «э», «эм» у російській, «äh», «ähm» у німецькій — для десяти мов: англійської, російської, української, іспанської, португальської, французької, німецької, італійської, польської та нідерландської. Список вибирається за мовою сторінки. Слова на кшталт «like», «you know» чи «o sea» навмисно не включено: це ще й звичайні слова, і наосліп прибирати їх — означає змінювати зміст. Якщо хочете прибрати їх, додайте їх до списку самі; працюють і фрази з кількох слів, а ваш список запам’ятовується в цьому браузері.
Чесні обмеження
Очищувач упорядковує текст, але не розуміє його. Він не може додати розділові знаки, яких у джерелі ніколи не було, не виправить неправильно почуті слова, а рядок, що починається з великого слова й двокрапки («Note: …»), може прийняти за позначку мовця — тому цей параметр за замовчуванням вимкнено. Прочитайте результат, перш ніж публікувати. Усе виконується у вашому браузері; текст не завантажується й не зберігається.
Відповіді
Очищення транскрипту — поширені запитання
Як прибрати переноси рядків із транскрипту?
Вставте текст і залиште ввімкненим «Склеїти розірвані рядки». Рядки, обірвані посеред речення, склеюються в абзаци, слова, розірвані дефісом, збираються назад, а нові абзаци починаються кожні кілька речень або під час зміни мовця.
Як прибрати тайм-коди з транскрипту YouTube?
Вставте його з ввімкненим «Прибрати тайм-коди». Працюють обидва формати: панель транскрипту YouTube з часом в окремому рядку та формат [хх:сс], який копіює наш інструмент транскрипту YouTube. Час посеред речення лишається недоторканим.
Чи можна перетворити файл SRT або VTT на простий текст?
Так. Вставте його або відкрийте файл: номери реплік, рядки з таймінгом, заголовки VTT і теги форматування видаляються, повторювані рядки автосубтитрів YouTube відкидаються, а текст склеюється в абзаци.
Які слова-паразити прибираються?
Лише звуки-запинки, наприклад um, uh та erm в англійській, із вбудованих списків для десяти мов. Слів на кшталт «like» чи «you know» у списку немає, бо це ще й звичайні слова. Список можна редагувати й додавати до нього будь-які слова та фрази.
Чому абзаци розрізано в дивних місцях?
Найімовірніше, у тексті немає розділових знаків між реченнями — це типово для автосубтитрів. Без крапок рахувати речення нічого, тому абзаци ріжуться за довжиною. Виберіть «Залишити абзаци як є», щоб це вимкнути.
Чи додасть він відсутню пунктуацію?
Ні. Він виправляє пробіли та робить великими початки речень, але не може вигадати крапки й коми, яких ніколи не було. Для тексту з нормальною пунктуацією розшифруйте саме аудіозапис, а не чистьте автосубтитри.
Мій текст завантажується?
Ні. Очищення відбувається у вашому браузері, текст нікуди не надсилається й не зберігається. На цьому пристрої запам’ятовуються лише вибрані параметри та ваші списки слів-паразитів.
Потрібна повна транскрипція?
Завантажте аудіо або вставте посилання на YouTube і отримайте повну AI-транскрипцію з позначками мовців, часовими мітками та підсумками.
Безкоштовно на iOS та Android. Обліковий запис не потрібен.
Безкоштовні інструменти
Більше безкоштовних інструментів
YouTube Transcript Generator · SozAI vs Other Tools · Alternatives to Popular Apps