講義のSRTをノートにする
- 作業
- オンライン講座にSRTが付いていて、番号や時刻なしの文章だけ欲しい。
- 結果
- 各区間が1行または1段落になり、区間内の改行は結合済みで文書に貼り付けられます。
- 確認
- 区切りは文ではなく字幕区間に従います。句読点は元の字幕のままです。
字幕をテキスト化
SRT / VTT字幕からテキストを抽出。タイムコード、番号、スタイルタグ、YouTube自動字幕のスクロール重複を除き、UTF-8 TXTでコピー・保存。
形式だけを整理し、文字起こし、翻訳、要約、書き換えはしません
字幕トラック
サンプルSRTを読み込みました。そのまま変換するか、自分の字幕を貼り付けてください。
結果プレビュー
ボタンが1つだけのツールもあります。 ここでは時間、形式、制限を明確にします。 LOCAL FIRST:字幕テキストはブラウザから出ません。 話者:字幕は一括移動だけでなく、時間とともに増えるずれも補正できます。
UTF-8で出力します。WebVTTのミリ秒はピリオド、SRTはカンマです。
方法と制限
字幕内の改行は画面幅のためで、時刻や番号も本文ではありません。同じcueの行を結合し、任意でタグと話者接頭辞を除き、段落のリズムを残します。
重複の整理は隣り合う2つの字幕区間だけを比べます。完全に同じ区間は統合し、区間の先頭が前の区間の最終行を繰り返す場合(YouTube自動字幕のスクロール表示)は新しい行だけを残します。離れた同文や意味の近い文は削りません。
字幕区間を解析 → タグを整理 → 任意で隣接重複とスクロール重複を削除 → 区間内改行を結合 → 任意で話者接頭辞を削除 → UTF-8 TXT。
活用例
各例で作業内容、得られる結果、手動確認が必要な点を示します。手元のファイルと照らして確認できます。
よくある質問
.srtファイルをドロップするか貼り付けるだけです。時刻と番号は結果に含まれず、「保存 TXT」でUTF-8テキストとして保存できます。
.vttファイルなら対応します。単語ごとの時刻タグを削除し、「連続する重複文を統合」をオンにするとスクロール重複は1回だけ残ります。YouTubeから字幕を取得する機能はないため、先に.vttファイルが必要です。
できません。既存SRT/VTTを処理し、音声・動画の送信や音声認識は行いません。
同じ文が別の場所で重要な場合があります。隣接区間の完全一致とスクロール重複だけを扱うことで誤削除を抑えます。
同じ字幕区間内はスペースへ変換します。区間ごとは1行または空行付きで並べられます。