字符编码 的英文是 Character Encoding
领域:内容全球化
常见误译:常见错误是用错误编码打开或保存文件,把特殊字符悄悄转成乱码或替换符。
字符编码是把字符映射为字节序列的规则,使文本能在不同软件系统中一致地存储、传输和显示。在翻译和本地化流程中,使用 UTF-8 等正确编码对保留多语言文字至关重要,可防止源文件、翻译记忆、网页内容和本地化交付物在工具或平台间传输时出现乱码。
字符编码在准备源文件、配置 CAT 工具、导入翻译记忆以及交付网页、XML 或 JSON 内容时都需要处理。本地化工程师会检查 HTML、XML、JSON 和数据库中的编码声明,并在翻译前把旧文件转为 UTF-8,避免数据丢失或乱码。
常见错误是用错误编码打开或保存文件,把特殊字符悄悄转成乱码或替换符。这种损坏往往到审校或发布阶段才被发现,会污染译文、破坏 XML 或 JSON 解析,并迫使整批文件重新处理和返工。
对于创意和消费类内容,主要风险是表达平淡,而非不准确——而表达平淡的内容往往也能通过准确性检查。此外,此类术语还受到技术限制(如阅读速度、字符预算)的约束,这些也是项目简报的一部分。
天使翻译在专家审校开始前,会将此类术语锁定至项目术语库,确保同一源术语在提交的所有文档中保持一致。