SRT 字幕出现 䏿–‡、涓枃、问号或黑菱形时,先别逐字修改。多数情况不是翻译错了,而是文件写入时使用的编码与播放器读取时采用的编码不一致。安全修复顺序是:备份原文件、按正确源编码重新打开、另存为 UTF-8、验证时间码,再上传翻译或发布。
先分清:乱码、替换字符和缺字方框不是一回事
SRT 本质上是带序号、时间码和字幕文本的纯文本文件。Subtitle Edit 的SRT 格式参考给出的基本结构是“序号—时间码—文本—空行”,并建议国际化字幕优先使用 UTF-8。
看到异常时先按表现判断:
- 成串拉丁字符或无意义汉字:常见于 UTF-8、GBK、GB18030 或 Windows-1252 被用错方式解码,原始字节通常还在。
- 出现
�替换字符:解码器已经无法解释原字节;若保存覆盖,丢失部分可能无法恢复。 - 全部变成问号:内容可能在更早的导出环节就被替换,单纯改编码未必能救回。
- 文字正确但显示为方框:更像播放器缺少目标语言字体,不一定是编码问题。
- 时间码可见、字幕不加载:还要检查逗号、箭头和字幕块之间的空行,不能只盯着编码。
图 1:先按异常表现判断编码、数据丢失、字体或结构问题。
UTF-8、GBK 和 Windows-1252 为什么会互相读错
编码规定“字符如何写成字节”。简体中文旧字幕常见 GBK/GB18030,西欧语言旧文件可能使用 Windows-1252;现代跨语言工作流通常使用 UTF-8。播放器若把 GBK 字节当 UTF-8,或把 UTF-8 当单字节编码,画面就会出现乱码。
不要直接把乱码文本复制到新文件。正确做法是让编辑器用候选源编码重新打开原始字节,直到姓名、标点和生僻字都可读,再另存新文件。若原件已被带 � 的版本覆盖,应回到剪辑软件、云盘版本记录或发送方重新导出。
BOM 到底要不要保留
BOM 是文件开头的编码标记。Unicode 的BOM 官方说明指出,UTF-8 没有大小端顺序问题;其 BOM 只充当 UTF-8 签名,部分接收程序并不期待它。W3C 也说明,不识别 BOM 的程序可能把它显示为  等额外字符。
因此没有适用于所有平台的单一答案:
- 未指定交付规范时,可优先保存为 UTF-8 无 BOM,兼容性通常更广。
- 目标平台明确要求 BOM 时,应为该平台另存 UTF-8 with BOM 交付副本。例如 TechSmith 的Camtasia 支持说明要求用带 BOM 的 UTF-8 重新保存特定无法导入的 SRT。
- 不要反复在“有 BOM/无 BOM”之间猜。先查目标播放器或发布平台规范,并用最终平台实测。
五步无损修复 SRT 编码
第一步:复制原件
保留只读原件,例如 course01_zh_original.srt;修复文件另存为 course01_zh_utf8.srt。不要覆盖唯一来源。
第二步:以候选编码重新打开
在支持“以编码重新打开”的编辑器中依次尝试 UTF-8、GB18030/GBK、繁体中文常见编码、Shift-JIS 或 Windows-1252。根据字幕语言和来源缩小范围,不要只看第一行。
第三步:抽查不可逆字符
搜索 �、连续问号和异常控制字符;再抽查人名、重音符号、日韩文字及片尾字幕。如果原文件打开后已丢字,停止转存并寻找上游原件。
第四步:另存 UTF-8 新文件
默认选择 UTF-8 无 BOM;只有目标平台明确要求时才生成带 BOM 的交付副本。保持 .srt 后缀,不要让编辑器悄悄保存成 .srt.txt。
第五步:验证 SRT 结构
检查序号递增、时间码形如 00:00:01,000 --> 00:00:03,000、字幕块之间有空行。对照原件抽查首、中、尾至少 20 条,并在目标播放器中加载一次。
图 2:以正确编码重新读取原始字节,再另存新文件,避免覆盖数据。
用 OLTranslation 翻译前后的编码检查
OLTranslation 当前支持 SRT、VTT、ASS/SSA 字幕。SRT 处理会先检测编码,并在需要时依次尝试 UTF-8 with BOM、UTF-8、GBK、GB2312、ISO-8859-1、Windows-1252 等候选编码;译文 SRT 以 UTF-8 输出。自动检测可能在短文件、混合编码或损坏文件上判断失误,所以乱码应在上传前修复。
- 修复后的 SRT 先在文本编辑器和播放器中确认可读。
- 从字幕文件翻译上传,选择源语言和目标语言。
- 确认系统分析的额度后再创建任务。
- 下载译文,抽查首、中、尾字幕的文字、序号与时间码。
- 若目标平台要求 UTF-8 with BOM,在保留下载原件的前提下另存交付副本。
图 3:编码修复在翻译前完成,BOM 适配在目标平台验收时完成。
时间轴检查可参考 SRT 翻译后时间轴会变吗;需要选择格式时可读 ASS 和 SRT 字幕翻译区别;网课项目则可配合课程字幕翻译全流程管理术语和批次。
额度、付费与能力边界
OLTranslation 是按可用额度使用的付费字幕翻译服务,不是永久免费工具。字幕文件当前按每 2000 字符折算 1 页,不足 1 页按 1 页计;实际扣减以上传分析结果为准。
注册赠送页数属于有限活动权益,不代表所有字幕都能免费翻译。套餐价格、额度、限制和有效期可能调整,请以支付与套餐页面及账户实时信息为准。
系统可以尝试识别多种常见编码,但不能恢复已经被问号或 � 覆盖的原文,也不能保证混合编码文件自动修复。它不会替代目标播放器的字体安装、平台导入规范或人工字幕校对。用于影视发行、无障碍字幕或高风险专业内容时,应增加母语审校和平台验收。
常见问题
问:把文件后缀改成 .utf8.srt 能修复乱码吗?
答:不能。文件名不改变内部字节。必须用正确源编码重新打开,再以 UTF-8 另存。
问:看到 � 后还能无损恢复吗?
答:如果只是播放器临时显示,换正确编码仍可能恢复;如果已保存覆盖,原字节可能丢失,应找原始导出文件或版本记录。
问:SRT 一定要使用 UTF-8 with BOM 吗?
答:不一定。通用交付可优先 UTF-8 无 BOM;个别软件明确要求 BOM 时,为该平台另存副本并实测。
问:为什么文字正确,播放器里却全是方框?
答:先检查播放器是否有目标语言字体。换字体后恢复,说明是字形缺失而不是编码错误。
问:OLTranslation 会自动修复所有乱码吗?
答:不会。系统会尝试检测常见编码,但已损坏、混合编码或极短文件仍需人工确认,上传前应先保证源字幕可读。
问:字幕翻译如何计算额度?
答:当前按每 2000 字符折算 1 页,不足 1 页按 1 页计。这是付费额度规则,实际扣减以上传分析结果为准。
总结
修复 SRT 乱码的核心不是“换一个后缀”,而是从未损坏的原始字节出发,用正确源编码重新打开,再另存为适合目标平台的 UTF-8 文件。默认可优先无 BOM,平台明确要求时再制作带 BOM 副本。完成文字、时间码、字体和播放器四轮检查后,再进入付费翻译流程,才能避免乱码被永久写入译文。
准备好翻译你的文档了吗?
上传文件、选择目标语言,即可开始文档翻译。
- 支持 Word、PDF、PPT、Excel
- 文件加密传输
- 翻译将按账户额度扣减