**去除换行和时间戳 — 文字稿清理工具 | SozAI**
Source: https://sozai.app/zh/tools/transcript-cleaner/

免费工具

# 去除换行与时间戳：文字稿清理工具

去掉文字稿中的换行、时间戳、声音标签和口头语，得到便于阅读的段落。粘贴文字，选好要清理的内容，复制结果。

- 在浏览器中运行
- 不会上传任何内容
- 无需注册

要清理的文字稿 打开文件

清理后的文字

要清理什么 去除时间戳 [00:12]、单独成行的 0:12、1:02:03、SRT/VTT 时间行和字幕序号 合并断开的行 在句子中间被切断的行会变成一个段落；被连字符拆开的词会重新拼好 去除声音标签 [Music]、[Applause]、(laughs)、♪ 修正空格和大小写 双空格、逗号前的空格、以小写字母开头的句子 去除说话人标签“Speaker 1:”“John:”“>>”——说话人每次改变仍会另起一段 去除口头语 下面词表中的犹豫语气声

段落数

口头语词表

语言

  口头语，用逗号分隔

默认只列出从不承载意义的声音。像“like”或“you know”这样的词也是真正的词——如果想去掉它们，请自己添加。由多个词组成的短语也可以。

在你的浏览器中运行——文字不会被上传。清理工具无法添加原本没有的标点：自动生成的字幕没有句号，所以发布前请检查结果。

使用方法

## 去除换行与时间戳：文字稿清理工具，三步完成

01

### 粘贴文字稿

来自我们的 YouTube 文字稿工具、YouTube 的文字稿面板，或 SRT、VTT 文件。

02

### 选择要清理的内容

时间戳、断开的行、声音标签、口头语、说话人标签——每一项都是一个开关。

03

### 复制整洁的段落

更改选项时结果会实时更新。复制它，或下载 .txt 文件。

## 清理工具会去掉什么

从视频播放器里复制的文字稿是为了边看边跟读，而不是为了阅读：每隔几秒一个时间戳，字幕在哪儿结束就在哪儿换行，句子中间还冒出 `[Music]` 。清理工具会剥掉这些“脚手架”，给你段落。每个选项都可以关闭，结果会随你输入实时更新。

| 选项 | 之前 | 之后 |
| --- | --- | --- |
| 去除时间戳 | `[02:14] so the first thing` | So the first thing |
| 去除时间戳（字幕文件） | `12` / `00:00:41,200 --> 00:00:43,900` / text | Text |
| 合并断开的行 | the brain keeps what it uses | The brain keeps what it uses |
| 去除声音标签 | it fades [Applause] fast | It fades fast |
| 去除口头语 | So, um, I think, uh, yes | So, I think, yes |
| 去除说话人标签 | Speaker 1: Hello | Hello |

## 它能识别哪些格式

- **我们的 YouTube 文字稿**——每一段前面带有 `[mm:ss] Speaker A:` 的那种复制格式。同一说话人的片段会被合并，每个段落只写一次说话人标签。
- **YouTube 自己的文字稿面板**——时间在一行，文字在下一行。时间行会被去掉，包括有些复制结果里带的口语形式（“1 minute, 5 seconds”）。
- **SRT、WebVTT 和 SBV 字幕文件**——字幕序号、时间行、VTT 文件头、注释和行内标签都会去掉；VTT 的说话人标签会变成说话人标签；自动字幕每条顶部重复的那一行会被删除。
- **会议记录** 里姓名和时间各占一行的写法（“Speaker 1 0:03”）会变成“Speaker 1:”。

只有看起来像时间戳的内容才会被去掉：位于行首、单独成行或放在括号里的。句子中间的“We meet at 10:30”会原样保留。

## 段落是怎么重建的

当文字来自播放器时，每个换行都被视为字幕的结束而不是段落的结束，所以先把各行合并起来。被连字符分在两行的单词会重新拼好。然后每 3、4、5、6 或 8 句开始一个新段落（默认 4 句），说话人改变时总会另起一段。你自己输入的文字则保留原来用空行分隔的段落。

自动生成的字幕通常完全没有句号，所以没有句子可数。当文本平均每句超过 60 个词时，清理工具会改按长度切分段落——你要求的每一句大约对应 20 个词——并告诉你这么做了。

“修正空格和大小写”会去掉双空格以及逗号、句号前的空格，补上逗号后缺失的空格，并把每个句子的首字母大写。像“Dr.”这样的缩写和“U.S.A.”这样的首字母缩写不会结束一个句子，而“iPhone”这样的词会保留它的首字母。

## 口头语，谨慎处理

默认词表只包含犹豫的语气声——英语的“um”“uh”“erm”，俄语的“э”“эм”，德语的“äh”“ähm”——涵盖十种语言：英语、俄语、乌克兰语、西班牙语、葡萄牙语、法语、德语、意大利语、波兰语和荷兰语。页面语言决定使用哪个词表。像“like”“you know”或“o sea”这样的词是有意排除的：它们同时也是普通词，盲目删除会改变意思。如果想把它们去掉，请自己加入词表；由多个词组成的短语也可以，你的词表会被记在这个浏览器里。

## 局限

清理工具整理的是文字，并不理解文字。它无法补上原文从来没有的标点，无法纠正听错的词，而以首字母大写的单词加冒号开头的行（“Note: …”）可能被误认为说话人标签——所以这个选项默认关闭。发布之前请先读一遍结果。一切都在你的浏览器中运行；文字不会被上传或存储。

答案

## 文字稿清理工具常见问题

怎样去掉文字稿中的换行？

粘贴文字，并保持“合并断开的行”开启。在句子中间被切断的行会合并成段落，被连字符拆开的词会重新拼好，每隔几句或说话人改变时会开始新的段落。

怎样去掉 YouTube 文字稿中的时间戳？

粘贴后开启“去除时间戳”。两种格式都可以：时间单独占一行的 YouTube 文字稿面板，以及我们的 YouTube 文字稿工具复制出来的 [mm:ss] 格式。句子中间的时间会保持不动。

能把 SRT 或 VTT 文件清理成纯文本吗？

可以。粘贴或打开文件：字幕序号、时间行、VTT 文件头和格式标签会被去掉，YouTube 自动字幕的重复行会被删除，文字合并成段落。

会去掉哪些口头语？

只去掉犹豫的语气声，比如英语的 um、uh 和 erm，来自十种语言的内置词表。像“like”或“you know”这样的词不在词表里，因为它们同时也是真正的词。你可以编辑词表，加入任何词或短语。

为什么我的段落切在奇怪的地方？

可能是因为文本没有句子标点——这在自动生成的字幕中很典型。没有句号就没有句子可数，所以段落按长度切分。选择“保持段落原样”即可关闭这一行为。

它会补上缺失的标点吗？

不会。它修正空格并把句首字母大写，但无法凭空添加从来没有的句号和逗号。想要标点齐全的文字稿，请直接转写音频，而不是清理自动字幕。

我的文字会被上传吗？

不会。清理在你的浏览器中完成，文字不会被发送到任何地方，也不会被保存。只有你的选项设置和自定义的口头语词表会记在这台设备上。

需要完整转录？

上传音频或粘贴 YouTube 链接，即可获取带说话人标签、时间戳和摘要的完整 AI 转录。

 [获取 App — 免费](https://sozai.app/zh/download/)

iOS 和 Android 免费使用。无需账号。

免费工具

## 更多免费工具

- [01 会议成本计算器](https://sozai.app/zh/tools/meeting-cost/)
- [02 在线提词器](https://sozai.app/zh/tools/teleprompter/)
- [03 在线计时器与秒表](https://sozai.app/zh/tools/timer/)
- [04 在线记事本](https://sozai.app/zh/tools/online-notepad/)
- [05 字数与字符计数器](https://sozai.app/zh/tools/word-counter/)
- [06 文本对比](https://sozai.app/zh/tools/text-compare/)
- [07 时码转换器](https://sozai.app/zh/tools/timecode-converter/)

[YouTube Transcript Generator](https://sozai.app/zh/youtube-transcript/) · [SozAI vs Other Tools](https://sozai.app/zh/compare/) · [Alternatives to Popular Apps](https://sozai.app/zh/alternatives/)


---
This is the markdown twin of https://sozai.app/zh/tools/transcript-cleaner/ — the same content, without the markup.
Published by SozAI (https://sozai.app). Reuse and quotation are allowed with attribution and a link back.
Machine-readable index: https://sozai.app/llms.txt · data API: https://sozai.app/api/
