字幕整理指南
中文字幕變亂碼?先確認編碼,再另存 UTF-8
把亂碼檔案直接另存為 UTF-8,未必能救回文字。關鍵是先讓原檔在文字編輯器裡正確顯示,再輸出成字序可讀的 UTF-8。
先保留原始檔。請另存副本再操作。字序只接受 UTF-8 檔案,不會自動猜測 Big5、GB18030 或其他來源編碼。
先分辨你看到的是哪種問題
- 文字變成無意義的符號或其他字:可能用了不符原檔的編碼讀取,也可能在更早的轉存過程已經損壞。
- 出現「�」:內容中有 Unicode 替代字元。字序遇到這個字元會停止整理,避免將已無法辨識的文字當作正常輸出。
- 只有播放器顯示空心方框:如果文字編輯器與字序能正確顯示,先檢查播放器字型是否包含那些字,不要急著改字幕內容。
- 文字正常,但顯示找不到時間碼:通常應先排查字幕格式,不是只更換編碼。
用原檔重新讀取,再另存副本
- 用支援「以指定編碼重新開啟」的純文字編輯器,開啟原始字幕。不同編輯器的功能名稱可能不同。
- 向檔案來源確認編碼;例如已知來源是 Big5,才用 Big5 重新開啟。不要只根據繁體或簡體外觀就認定編碼。
- 檢查至少三處:開頭、中段與結尾。中文、標點、人名與特殊符號都應能辨識。
- 確認文字已正確顯示後,以 UTF-8 另存一個新檔,保留 .srt 或 .vtt 副檔名。
- 在字序匯入新檔,先關閉分行和空白清理,完成整理後再與原文比對。
「重新開啟」和「另存編碼」差在哪裡?
重新開啟,是重新解讀原檔的位元組;另存則是把編輯器目前顯示的文字寫成新檔。如果眼前已是亂碼,另存 UTF-8 可能只是把亂碼保存下來。這也是需要保留未修改原檔的原因。
若只剩下已被替換成「�」或問號的版本,重新切換編碼不一定能復原。較可靠的做法是找原始備份、向來源重新取得字幕,或對照影片手動補回;工具無法推算已遺失的文字。
副檔名和編碼要分開處理
把 字幕.txt 改名成 字幕.srt 不會改變編碼,也不會補上字幕時間碼。SRT 沒有單一強制字元編碼;字序的輸入規則則是 UTF-8。WebVTT 規格要求使用 UTF-8,所以格式互轉前也需要先把文字正確讀入。
快速檢查下載流程是否正常
先下載字序的 UTF-8 中文範例並匯入。範例應顯示「先保留一份原始字幕。」與「確認時間與文字,再匯出。」兩段。若範例正常、原檔異常,就回到原檔編碼與內容檢查;若只有某個播放器異常,請在該播放器檢查字幕設定。
字序下載結果使用 UTF-8,不提供 Big5 匯出。要轉 SRT 與 VTT,請參考格式互轉指南。
格式參考:美國國會圖書館:SRT 編碼說明、W3C WebVTT 規格。
更新日期:。範例為本站示範內容。
開啟字幕工作台