S1000D 多语言、本地化与翻译记忆怎么管理?
S1000D 多语言项目不仅是把中文句子翻译成另一种语言,还要同时管理数据模块版本、术语、翻译记忆、图形文字、单位、适用性和发布状态。把语言版本纳入结构化内容生命周期,才能在源数据更新后知道哪些译文需要重译、复核和重新发布。
S1000D 本地化包括哪些内容?
本地化要处理的对象比正文翻译更广。除了数据模块的文本,还包括警告和注意的表达、标题和目录、交叉引用、单位与数值格式、图形标注、热点、零件表、术语、适用性说明以及不同语言的阅读和发布要求。
| 对象 | 本地化任务 | 常见风险 |
|---|---|---|
| 数据模块正文 | 翻译描述、程序、故障隔离、零件和操作信息,保持结构和引用关系。 | 漏译、错译、上下文丢失,或翻译后破坏标记和变量。 |
| 安全信息 | 统一 warning、caution、note 等安全措辞和严重级别表达。 | 语气被弱化、顺序改变,读者误解前置条件或禁止事项。 |
| 术语与代码 | 维护受控术语、缩写、产品名称、部件名称和不可翻译项。 | 同一概念多种译法、缩写不一致、专有名词被误译。 |
| 图形与媒体 | 翻译图题、标注、图例、热点和音视频字幕,处理文字溢出。 | 图形仍显示源语言、编号错位、字体缺字或热点与文本不一致。 |
| 发布和适用性 | 按语言、市场、构型和手册类型生成对应交付物。 | 目录缺页、语言版本混用、适用性筛选后缺少译文。 |
语言版本如何与数据模块生命周期关联?
建议以数据模块为单位建立源语言、目标语言、翻译状态和审核状态。源模块更新后,系统应能定位受影响的译文、图形和出版物,而不是依靠文件夹名称或人工记忆判断哪些内容需要重译。
| 管理维度 | 建议做法 | 需要留存的记录 |
|---|---|---|
| 语言标识 | 明确源语言、目标语言、国家或地区变体,以及项目采用的语言代码规则。 | 语言清单、代码映射、目标市场和交付范围。 |
| 模块关联 | 让译文与源模块保持可追溯关联,记录源版本、译文版本和更新时间。 | 源译关系、DMC/版本、变更影响和重译队列。 |
| 状态管理 | 区分待翻译、翻译中、译审中、已批准、过期和需重译状态。 | 状态变更人、审批记录、未决问题和发布门禁。 |
| 适用性继承 | 明确语言版本是否继承源模块的产品构型和条件,差异时建立例外。 | 适用性测试矩阵、语言与构型覆盖表。 |
| 发布组合 | 按语言和产品构型装配 PM,避免不同语言模块被意外混装。 | 发布参数、PM 版本、模块清单和验收包。 |
语言版本的身份、状态和引用应以项目采用的 S1000D Issue、Data Dictionary、Schema 和 BREX 为准。不要只用后缀、目录或文件名来表达语言关系。
术语库、翻译记忆和机器翻译如何配合?
术语库负责“应该怎样称呼”,翻译记忆负责“过去怎样翻译过”,机器翻译负责“生成候选译文”。三者可以协同,但都不能替代技术专家和语言审核人员对上下文、安全信息和产品术语的判断。
| 资源 | 主要作用 | 维护重点 |
|---|---|---|
| 受控术语库 | 规定部件、动作、系统、警告和界面术语的首选译法及禁用译法。 | 定义、上下文、词性、缩写、批准人、版本和适用产品。 |
| 翻译记忆(TM) | 复用已经审核的句段或结构化内容,减少重复翻译。 | 来源、语言对、领域、可信度、版本和过期内容清理。 |
| 术语提取与 QA | 发现新术语、未批准译法、大小写和一致性问题。 | 把自动提示分成错误、警告和建议,避免噪声淹没关键问题。 |
| 机器翻译 | 提供初稿或候选表达,加快大规模迁移。 | 禁止直接发布未经审核的安全关键、型号差异和法规内容。 |
图形文字、单位和格式如何本地化?
图形和媒体经常被遗漏,因为它们不一定出现在正文翻译工具的文本范围内。项目应先盘点图形对象、文字层、热点、图例、音频字幕和视频叠加文字,再决定哪些对象需要翻译、复绘或保持原样。
| 对象 | 检查内容 | 验收重点 |
|---|---|---|
| 图题、标注和图例 | 翻译文本、保持编号和指向关系,处理目标语言变长。 | 文字不遮挡零件、标注线不交叉、字号和字体可读。 |
| 热点与交互标签 | 同步热点名称、零件表、步骤说明和搜索索引。 | 点击对象与目标语言名称、编号和内容一致。 |
| 单位和数值 | 按合同或市场要求处理单位、千位分隔、小数符号和日期格式。 | 数值不被误转换,换算过程和原始值可追溯。 |
| 音频、视频和字幕 | 翻译旁白、字幕、屏幕文字和交互提示,记录媒体版本。 | 时间轴、字幕长度、术语和画面动作一致。 |
| 字体和编码 | 确认目标语言字符集、字体许可、换行和嵌入方式。 | 无缺字、乱码、异常断行或导出后字体替换。 |
多语言项目的实施流程
- 确定范围:明确源语言、目标语言、国家或地区变体、产品构型、手册类型和交付格式。
- 冻结源内容:完成源语言 Schema/BREX/完整性检查,建立源模块、媒体和术语基线。
- 建立语言资产:准备术语库、翻译记忆、风格指南、单位规则、禁译项和图形本地化规则。
- 建立源译关联:记录语言版本、源版本、译文状态、变更影响和重译条件。
- 翻译与译审:按模块和优先级翻译,优先处理安全、程序、配置差异和高复用内容。
- 多语言 QA:检查结构、术语、数字单位、引用、图形、媒体、语言标识和文本完整性。
- 按构型发布:分别用代表性语言和产品构型生成 PDF、IETP、Word 或交互阅读结果。
- 回归与维护:源模块、术语、配置或规则变化后,重新评估受影响语言版本并保留发布记录。
多语言质量检查清单
| 检查项 | 完成标准 | 责任角色 |
|---|---|---|
| 语言版本 | 源语言、目标语言、区域变体、模块状态和发布范围清楚可追溯。 | 项目负责人、内容管理员 |
| 术语一致性 | 受控术语、缩写、产品名称和禁译项已通过术语 QA。 | 术语负责人、语言审核人员 |
| 结构与引用 | 译文通过对应 Schema/BREX,DMC、DMRef、ICN、交叉引用和版本关系正确。 | 工具管理员、配置管理员 |
| 安全与技术内容 | 程序顺序、warning/caution/note、工具、单位和型号差异经技术与安全审核。 | 技术专家、维修专家、安全人员 |
| 图形与媒体 | 图题、标注、热点、零件表、字幕和媒体版本与目标语言正文一致。 | 多媒体人员、语言审核人员 |
| 适用性覆盖 | 每个目标语言和产品构型都有代表性测试,未出现缺页、错配或混用语言。 | 系统工程师、验收人员 |
| 版式与设备 | 目标语言文本、字体、换行、搜索和交互阅读在指定设备上可用。 | 发布人员、客户验收人员 |
常见问题和处理方式
| 问题 | 可能原因 | 处理建议 |
|---|---|---|
| 源文更新后译文仍显示旧内容 | 没有建立源译版本关联,或重译触发条件不明确。 | 比较源模块版本和变更类型,生成重译队列并重新译审。 |
| 同一部件出现多个译名 | 术语库未冻结,翻译记忆来源混杂或审核未回写。 | 确定首选术语,标记禁用译法,清理和更新翻译记忆。 |
| 目标语言页面文字溢出 | 译文变长、字体缺字、图形空间不足或模板未适配。 | 调整布局或复绘图形,重新检查图题、热点和 PDF/IETP 导出。 |
| 语言版本与构型不匹配 | 语言和适用性条件分别维护,PM 装配时混用了模块。 | 按语言×构型建立测试矩阵,检查目录、引用和发布参数。 |
| 翻译记忆复用了过期译文 | 旧版本没有标记失效,缺少领域、产品或状态过滤。 | 给 TM 片段绑定来源和版本,过期内容进入复核而非自动复用。 |
常见问题
S1000D 的语言版本应该复制整本手册吗?
通常不建议把每种语言维护成互不关联的整本文件。应以数据模块为单位管理语言版本和状态,保持 DMC、版本、适用性和引用关系可追溯,再按语言和构型组织出版物。
翻译记忆可以直接覆盖人工审核吗?
不能。翻译记忆可以提高重复内容的复用率,但术语、上下文、警告、单位和目标语言表达仍需译审人员确认,尤其是安全关键和型号差异内容。
图形中的文字要不要单独翻译?
需要纳入本地化范围。图形标题、标注、图例、热点和零件号可能需要替换或保持原样,应为每种语言建立图形版本、字体、布局和发布检查规则。
不同语言版本可以共用同一个 DMC 吗?
是否共用由采用的 S1000D Issue、DMC 规则和项目配置决定。语言、国家或地区、版本和状态必须能在模块身份与发布管理中明确区分,不能仅凭文件名猜测。
本地化验收最容易漏掉什么?
常见遗漏包括术语不一致、警告语气变化、单位和小数格式错误、图形文字未翻译、文本变长造成版式溢出、适用性筛选后语言版本缺页,以及交叉引用指向错误。
VizMan 与多语言交付
VizMan IETM 面向 S1000D Issue 5.0 与 GJB 6600 场景,提供结构化内容编辑、协同审核、术语和版本管理、适用性发布及交互阅读能力。具体项目仍需根据合同、目标市场、语言规则、产品配置和交付环境确认范围。