Filewisp

Amazon Transcribe JSONをSRT・VTT字幕に変換

Amazon TranscribeのJSON結果からタイムコードと話者ラベルを読み取り、SRT・WebVTT・TXT字幕へ変換します。

データ変換前後の確認ポイント

1変換前に確認

  • 元ファイルを残し、文字コードやデータ形式を確認してから変換します。
  • 先頭行が見出しか、列名やキーが期待どおりかを確認します。
  • 個人情報や機密データを含む場合は、処理場所と共有先を確認します。

2変換後に確認

  • プレビューで日本語、列名、行数が正しく読めているか確認します。
  • Excelや利用先のシステムで開き、日付や長い数値の表示も確認します。
  • 変換後のファイルは別名で保存し、元データと比較できるようにします。

次に続けやすい作業

Transcribe JSON字幕変換とは?

results.itemsの発音・句読点、またはaudio_segmentsを字幕キューへまとめ、タイムコード付きで保存します。既存JSONや字幕未出力のジョブに使えます。

単語時刻から読みやすい字幕へ

単語を句読点、文字数、時間、話者の切り替わりでまとめ、長すぎる字幕を分割します。speaker_labelsがある場合は[spk_0]のような話者名を先頭へ付けます。

SRTは動画編集ソフトで広く使われ、VTTはHTML videoなどWeb字幕に向きます。TXTはタイムコードなしの文字起こし確認用です。

読み取るTranscribe項目

  • results.itemsのstart_time・end_time
  • pronunciationとpunctuation
  • speaker_labels
  • results.audio_segments
  • results.transcriptsの全文

字幕形式の選び方

SRT
動画編集ソフトや動画サービスへ読み込む一般的な字幕形式です。
VTT
WebVTT対応プレーヤーやHTML videoで使いやすい形式です。
TXT
タイムコードを外した文字起こし本文です。

使い方

  1. 1Amazon TranscribeのJSON結果を選択します
  2. 2変換ボタンを押します
  3. 3字幕キューと話者を確認します
  4. 4SRT・VTT・TXTを選んで保存します

よくある質問

Amazon Transcribeは直接SRTを出せませんか?

現在のTranscribeはジョブ作成時に字幕出力を指定できます。このツールは既存JSONや字幕を指定しなかったジョブの変換に便利です。

話者ラベルを残せますか?

はい。speaker_labelsまたは各itemのspeaker_labelを字幕へ付けます。

日本語にも使えますか?

はい。日本語の句読点にも対応し、CJK文字の間へ不要な空白を入れないよう処理します。

あわせて使いやすい関連ツール

使い方に迷ったときはガイドも確認

画像形式の違い、圧縮のコツ、PDFのまとめ方などをガイドページで整理しています。

ガイド一覧を見る