Amazon Transcribe JSONをSRT・VTT字幕に変換
Amazon TranscribeのJSON結果からタイムコードと話者ラベルを読み取り、SRT・WebVTT・TXT字幕へ変換します。
データ変換前後の確認ポイント
1変換前に確認
- 元ファイルを残し、文字コードやデータ形式を確認してから変換します。
- 先頭行が見出しか、列名やキーが期待どおりかを確認します。
- 個人情報や機密データを含む場合は、処理場所と共有先を確認します。
2変換後に確認
- プレビューで日本語、列名、行数が正しく読めているか確認します。
- Excelや利用先のシステムで開き、日付や長い数値の表示も確認します。
- 変換後のファイルは別名で保存し、元データと比較できるようにします。
次に続けやすい作業
Transcribe JSON字幕変換とは?
results.itemsの発音・句読点、またはaudio_segmentsを字幕キューへまとめ、タイムコード付きで保存します。既存JSONや字幕未出力のジョブに使えます。
単語時刻から読みやすい字幕へ
単語を句読点、文字数、時間、話者の切り替わりでまとめ、長すぎる字幕を分割します。speaker_labelsがある場合は[spk_0]のような話者名を先頭へ付けます。
SRTは動画編集ソフトで広く使われ、VTTはHTML videoなどWeb字幕に向きます。TXTはタイムコードなしの文字起こし確認用です。
読み取るTranscribe項目
- results.itemsのstart_time・end_time
- pronunciationとpunctuation
- speaker_labels
- results.audio_segments
- results.transcriptsの全文
字幕形式の選び方
SRT
動画編集ソフトや動画サービスへ読み込む一般的な字幕形式です。
VTT
WebVTT対応プレーヤーやHTML videoで使いやすい形式です。
TXT
タイムコードを外した文字起こし本文です。
使い方
- 1Amazon TranscribeのJSON結果を選択します
- 2変換ボタンを押します
- 3字幕キューと話者を確認します
- 4SRT・VTT・TXTを選んで保存します
よくある質問
Amazon Transcribeは直接SRTを出せませんか?
現在のTranscribeはジョブ作成時に字幕出力を指定できます。このツールは既存JSONや字幕を指定しなかったジョブの変換に便利です。
話者ラベルを残せますか?
はい。speaker_labelsまたは各itemのspeaker_labelを字幕へ付けます。
日本語にも使えますか?
はい。日本語の句読点にも対応し、CJK文字の間へ不要な空白を入れないよう処理します。
あわせて使いやすい関連ツール
使い方に迷ったときはガイドも確認
画像形式の違い、圧縮のコツ、PDFのまとめ方などをガイドページで整理しています。