動画字幕のよくある質問20問
字幕制作で問題が集中するのは、いくつかの決まった工程です。フォーマットの書き方、音声の認識、翻訳を誤りなく済ませる方法、そして完成映像まで。最も多い20の質問をこの四グループに整理しました。つまずいたらまずここに来れば、たいていその場で位置を特定できます。網羅ではなく、頻度が最も高く、初心者がつまずきやすいものだけを選んでいます。
一、フォーマット系(5問)
SRTとVTTの違いは?
SRTはプレーンテキストで構造が最も単純。VTTは冒頭に WEBVTT マークがあり、スタイルと位置指定に対応し、主にWeb動画に使います。変換は SRT→VTT変換ツール。
SRTの一行はどの部分で構成されますか?
三部分です。連番・タイムコード(00:00:01,000 --> 00:00:02,500)・テキスト、行の間に空行。
タイムコードの形式は?
SRTはミリ秒にコンマ(00:00:01,000)、VTTはポイント(00:00:01.000)。混用しないこと。
字幕ファイルはどんな文字コードで保存すべき?
UTF-8(BOMなし)に統一し、改行はLF。プラットフォームをまたいで最も安定し、豆腐や疑問符を防ぎます。
ASSとSRTの違いは?
ASSはフォント・色・位置などのスタイルに対応し、焼き込みの精調整に向く。SRTはテキストのみ。変換は SRT→ASS変換ツール。
二、認識系(5問)
音声認識はどの言語に対応していますか?
原文言語は中国語・英語・日本語・韓国語に対応し、認識して元字幕にします。
認識が正確でないときは?
まず一行ずつ聞き合わせて校正し、固有名詞と数字に重点を。次に 字幕クリーンアップツール で重なりと形式を直します。
ノイズの多い映像は認識できますか?
認識はできますが、ノイズは精度を下げます。静かな環境での録音、マイクへの近接のほうが安定します。
アップロードした映像は保存されますか?
いいえ。SmileSubにアップロードした元映像は処理完了後に削除され、長期保存はしません。
認識結果をそのまま字幕に使えますか?
公開前に一度校正を、とくに用語と数字。誤字が完成版に流れ込むのを防ぎます。
三、翻訳系(5問)
翻訳はどの言語に対応していますか?
中国語・英語・日本語・韓国語を含む20言語の相互翻訳。
翻訳でタイムコードが乱れますか?
専門ツールなら乱れません。タイムコードは別途解析し、テキストだけを翻訳し、最後に元の軸で組み立てます。
機械翻訳をそのまま公開できますか?
情報系のナレーションなら可。専門用語やブランドの表記は人の手を一度推奨します。
用語の統一はどう担保しますか?
翻訳前に用語集を一枚決め、全文で同一概念に一つの訳語だけを使います。
バイリンガル字幕の作り方は?
バイリンガルSRT生成ツール にSRTをアップロードすれば、「原文+訳文」を直接生成します。
四、完成系(5問)
ソフト字幕と焼き込み字幕、どちらを選ぶ?
CCを受け付けるプラットフォームはソフト字幕でSEOを取り、SNSと広告は焼き込みで到達を保証します。両者は同じSRTを共有します。
焼き込み後にも字幕を直せますか?
焼き込んだ時点で固定です。直すなら元のSRTに戻って再書き出し。だから焼く前に必ず校正します。
字幕が画面からあふれたら?
行長を縮めるかフォントサイズを下げ、セーフエリアに沿って組版します。規格チェックが範囲外の行を列挙してくれます。
読了速度はどのくらいが適切?
中国語は毎秒9字以内、ラテン文字は毎秒20字以内、一行の表示は1〜7秒。
一本の映像に字幕は何種類必要?
チャネル次第です。YouTube系はソフト字幕、SNSは焼き込み、複数市場なら言語ごとのトラックを追加。
より体系的な納品の取捨は 焼き込み字幕とソフト字幕の違い を、完全な制作フローは 字幕翻訳の完全ワークフロー を参照してください。
よくある質問
アップロードした映像はプラットフォームに保存されますか?
保存されません。SmileSubは処理完了後に元映像を削除し、長期保存しません。「ファイルがサーバーに残る」タイプのツールとはここが違い、機密性の高い素材も安心してアップロードして処理できます。
翻訳でタイムコードは乱れますか?
乱りません。翻訳はテキストにだけ作用し、タイムコードは別途解析されたデータで、最後に元の時間軸で組み立てられます。乱れやすいのは手動のコピペで——構造化データが連続テキストになったあとの再分割には検証がありません。
字幕が画面からあふれるときの収め方は?
まず一行の字数を減らし、それでもだめならフォントサイズを調整、常にセーフエリアを守ります。規格チェックツールで範囲外の行を一括列挙するほうが、目視で一行ずつ探すより効率的です。
