無料ツール
文字起こしクリーナー
文字起こしから改行、タイムスタンプ、効果音タグ、フィラーを取り除き、読みやすい段落にします。貼り付けて、整える項目を選び、結果をコピーするだけです。
- ブラウザ上で動作
- データはアップロードされません
- 登録不要
フィラーのリスト
既定では、意味を持たない音だけを載せています。「like」や「you know」のような語は普通の言葉でもあるので、消したい場合は自分で追加してください。複数語のフレーズも使えます。
ブラウザ内で動作し、テキストはアップロードされません。クリーナーは、元にない句読点を足すことはできません。自動生成の字幕にはピリオドがないため、公開する前に結果を確認してください。
先に動画の文字起こしが必要ですか?YouTubeのリンクから取得 →
使い方
文字起こしクリーナーを3ステップで
文字起こしを貼り付ける
当サイトのYouTube文字起こしツール、YouTubeの文字起こしパネル、またはSRTやVTTファイルから。
整える項目を選ぶ
タイムスタンプ、途切れた行、効果音タグ、フィラー、話者ラベルを、それぞれスイッチで選べます。
きれいな段落をコピー
オプションを変えるたびに結果が更新されます。コピーするか、.txtファイルでダウンロードできます。
クリーナーが取り除くもの
動画プレーヤーからコピーした文字起こしは、読むためではなく、見ながら追うために作られています。数秒ごとのタイムスタンプ、字幕が終わるたびの改行、文の途中に入った [Music] などです。クリーナーはそうした足場を取り除いて段落にします。どのオプションもオフにでき、入力するたびに結果が更新されます。
| オプション | 変換前 | 変換後 |
|---|---|---|
| タイムスタンプを削除 | [02:14] so the first thing | So the first thing |
| タイムスタンプを削除(字幕ファイル) | 12 / 00:00:41,200 --> 00:00:43,900 / text | Text |
| 途切れた行を結合 | the brain keeps what it uses | The brain keeps what it uses |
| 効果音タグを削除 | it fades [Applause] fast | It fades fast |
| フィラーを削除 | So, um, I think, uh, yes | So, I think, yes |
| 話者ラベルを削除 | Speaker 1: Hello | Hello |
対応している形式
- 当サイトのYouTube文字起こし — 各区間の前に
[mm:ss] Speaker A:が付いたコピーです。同じ話者の区間は結合され、話者ラベルは段落ごとに1回だけ書かれます。 - YouTube自身の文字起こしパネル — 時刻が1行、その次の行に言葉があります。時刻の行は削除され、コピーによっては含まれる読み上げ形式(「1 minute, 5 seconds」)も対象です。
- SRT、WebVTT、SBVの字幕ファイル — キュー番号、タイミング行、VTTのヘッダ、ノート、インラインタグが取り除かれ、VTTのvoiceタグは話者ラベルになり、自動字幕の各キューの先頭にある繰り返しの行も削除されます。
- 会議メモで、名前と時刻が単独の行にあるもの(「Speaker 1 0:03」)は、「Speaker 1:」になります。
タイムスタンプとして削除されるのは、タイムスタンプらしい形のものだけです。行頭にあるもの、単独の行にあるもの、角括弧で囲まれたものです。文の途中の「We meet at 10:30」はそのまま残ります。
段落の組み立て直し
プレーヤー由来のテキストでは、すべての改行を段落の区切りではなく字幕の終わりとして扱うので、まず行が結合されます。ハイフンで2行に分かれた単語は元に戻されます。そのあと、3、4、5、6、8文ごと(既定は4)に新しい段落が始まり、話者が変わったときは必ず始まります。自分で入力したテキストの空行による段落は、そのまま保たれます。
自動生成の字幕には、ふつうピリオドがまったくなく、数えるべき文がありません。1文あたり平均60語を超えるテキストでは、クリーナーは代わりに長さで段落を区切ります(指定した文数1つにつき約20語)。その場合はそう表示されます。
「スペースと大文字を整える」は、二重スペースやカンマ・ピリオドの前のスペースを取り除き、カンマの後ろに足りないスペースを補い、各文の先頭を大文字にします。「Dr.」のような略語や「U.S.A.」のようなイニシャルは文の終わりとは見なされず、「iPhone」のような語は最初の文字がそのまま保たれます。
フィラーは慎重に
既定のリストには、ためらいの音だけが入っています。英語の「um」「uh」「erm」、ロシア語の「э」「эм」、ドイツ語の「äh」「ähm」などで、英語、ロシア語、ウクライナ語、スペイン語、ポルトガル語、フランス語、ドイツ語、イタリア語、ポーランド語、オランダ語の10言語に対応します。ページの言語によって、使うリストが決まります。「like」「you know」「o sea」のような語は、あえて入れていません。普通の言葉でもあるため、むやみに消すと意味が変わってしまうからです。消したい場合は自分でリストに追加してください。複数語のフレーズも使え、リストはこのブラウザに記憶されます。
正直な制限
クリーナーはテキストを整えるだけで、内容を理解するわけではありません。元になかった句読点を足すことも、聞き間違いを直すこともできません。また、大文字で始まる単語とコロンで始まる行(「Note: …」)は話者ラベルと間違われることがあるため、そのオプションは既定ではオフです。公開する前に結果を読んでください。すべてブラウザ内で動作し、テキストはアップロードも保存もされません。
回答
文字起こしクリーナーのよくある質問
文字起こしから改行を削除するには?
テキストを貼り付けて、「途切れた行を結合」をオンのままにしてください。文の途中で切れた行は段落にまとめられ、ハイフンで分かれた単語は元に戻り、数文ごと、または話者が変わるところで新しい段落が始まります。
YouTubeの文字起こしからタイムスタンプを削除するには?
「タイムスタンプを削除」をオンにして貼り付けます。時刻が単独の行にあるYouTubeの文字起こしパネルと、当サイトのYouTube文字起こしツールがコピーする [mm:ss] 形式のどちらにも対応しています。文の途中の時刻は変更されません。
SRTやVTTファイルをプレーンテキストにできますか?
はい。貼り付けるかファイルを開くと、キュー番号、タイミング行、VTTのヘッダ、書式タグが削除され、YouTube自動字幕の繰り返しの行は除かれ、テキストが段落にまとめられます。
どのフィラーが削除されますか?
英語のum、uh、ermのような、ためらいの音だけです。10言語の内蔵リストを使います。「like」や「you know」のような語は、普通の言葉でもあるためリストに入っていません。リストは編集でき、好きな語やフレーズを追加できます。
段落が変なところで区切られるのはなぜ?
おそらく、テキストに文の区切りの句読点がないためです。自動生成の字幕によくあります。ピリオドがないと数える文がないので、段落は長さで区切られます。「段落はそのまま残す」を選ぶと、これをオフにできます。
足りない句読点を補ってくれますか?
いいえ。スペースを整え、文頭を大文字にしますが、元になかったピリオドやカンマを作り出すことはできません。句読点の入った文字起こしがほしい場合は、自動字幕を整えるのではなく、音声そのものを文字起こししてください。
テキストはアップロードされますか?
いいえ。整形はブラウザ内で行われ、テキストはどこにも送信も保存もされません。この端末に記憶されるのは、オプションの選択と、自分で作ったフィラーのリストだけです。
フル文字起こしが必要ですか?
音声をアップロードするか YouTube リンクを貼り付けるだけで、話者ラベル・タイムスタンプ・要約付きの完全なAI文字起こしを取得できます。
iOSとAndroidで無料。アカウント登録不要。