术语与翻译记忆
状态: Active Last verified: 2026-08-30 @ user-help content audit 适用范围: Studio 和插件可关联的 CSV 术语表,以及 Studio 在已配置路径存在时可读取的翻译记忆(TM)和人工修正记忆(CM)。
知识来源用于提高一致性、显示可追溯的候选结果;它们不替代图纸上下文审校。当前插件工作区只加载已关联的 CSV 术语表,不加载 TM/CM。Studio 从 project.profile.json 读取 TM/CM 路径;TM 未在 profile 中配置时,还可以回退到全局 tongwen.p1.json 的 tm_path,CM 没有对应的全局回退。本页不把人工编辑后自动沉淀为 TM/CM 当作既有用户功能承诺。
适用场景
- 同一术语、型号或标准在多张图中必须稳定翻译;
- 想让编号、缩写、尺寸代号等内容明确保持原样;
- 在 Studio 中已经配置 TM/CM 路径,需要判断某条结果来自术语、TM、CM 还是翻译服务。
开始前确认
- 已确认当前图纸的源语言、目标语言与专业领域;术语是否匹配取决于这些条件。
- CSV 中不包含 API Key、客户保密内容或不宜共享的地址。
- 术语表已放在
文档\Tongwen\glossaries\,或已通过 Studio 的术语库导入;仅保存到电脑任意位置并不会自动加入当前图纸。 - 你知道要把术语表关联到哪个项目/图纸范围。关联与保存完成前,不要把它当作本次翻译的约束。
- 如要使用 TM/CM,确认本次入口是 Studio,并且
TW_PROJECT_PROFILE指定的 profile(或默认的文档\Tongwen\project.profile.json)中路径指向存在、可读取的 JSON 文件;TM 还可使用全局tm_path回退。当前用户界面不会把工作区编辑自动收集为新的 TM/CM。
三种知识来源分别何时影响结果
| 名称 | 它解决的问题 | 当前可确认的行为 |
|---|---|---|
| 术语表(Glossary) | “这段术语应如何译/是否不译” | CSV 中的语言、领域、优先级和 do_not_translate 参与匹配;相关术语会作为翻译约束或直接候选。 |
| 翻译记忆(TM) | “同样原文是否已有可复用译文” | Studio 加载已配置 JSON 后,精确匹配可作为高优先级候选;插件工作区当前不加载。 |
| 人工修正记忆(CM) | “经过人工确认的修正是否应优先复用” | Studio 加载已配置 JSON 后,精确匹配优先于 TM 和术语候选;插件工作区当前不加载。 |
当 Studio 已实际加载这些知识文件时,同一原文的候选优先级是 CM → TM → 精确术语 → 翻译服务。未配置、路径不存在或从插件入口翻译时,不能假定 TM/CM 已参与。这一顺序也不说明结果已经通过工程语义或版面验收。
操作步骤
建立一份可维护的 CSV 术语表
- 在 Studio 的术语库中创建或导入 CSV;也可将已有 CSV 放入默认术语表目录后在术语库确认它可见。
- 使用以下列名。
source_text与target_text是正常可翻译术语的基本内容;不要用空目标文本表达“不翻译”。
source_text,target_text,source_language,target_language,domain,priority,do_not_translate,notes
设备基础,Equipment Foundation,zh,en,architecture,90,false,项目标准术语
DN100,DN100,*,*,mep,100,true,规格不翻译
| 字段 | 用法 |
|---|---|
source_text | 要匹配的原文术语或词组。 |
target_text | 指定目标译法;do_not_translate=true 时仍应写入便于维护的值。 |
source_language / target_language | 限定语言方向;* 表示通配。 |
domain | 限定专业领域;为空表示通用。 |
priority | 同条件冲突时数值更高者优先。 |
do_not_translate | 明确要求保留原文,适合型号、标准号、变量或固定缩写。 |
notes | 给维护者的解释,不是交付给翻译服务的保密备注。 |
- 把 CSV 关联到本次项目或图纸,保存关联,然后只重译一个明确的小范围验证命中。
- 在工作区检查实际译文和上下文;术语命中或高置信度不消除人工校对需求。
处理冲突和长期修正
- 同一原文有多个译法时,先检查语言、领域和
priority,再删除或降级过期条目。 - 对不应翻译的内容使用
do_not_translate=true;不要依赖模型自行猜测型号、尺寸、变量或符号。 - 用户在工作区改正了一条结果时,先保存会话并把可复用的项目标准显式维护进受控 CSV。不要假定任意编辑已经自动写进 TM 或 CM。
- 如组织已经为 Studio 配置 TM/CM JSON,把它们视为只读候选来源:仍需在另一张实际图纸的正确语言/领域下验证,而不是仅确认一条记录存在。插件用户应把需要稳定复用的规则显式维护到 CSV 术语表。
预期结果
- 当前图纸使用的是可识别、可追溯的 CSV 版本;
- 项目关键术语、型号和“不翻译”内容不依赖随机模型判断;
- 冲突在术语表中解决,而不是只在某一次显示文本中临时遮盖;
- 长期规则的来源明确;使用 Studio 时能确认 TM/CM 是否真的加载,使用插件时不会把它们误认为已经参与;每次输出前仍经过人工校对。
常见问题与安全恢复
- 术语没有生效:确认 CSV 已关联并保存到当前项目/图纸;再检查语言、领域、优先级和列名。不要靠重复整图翻译猜测原因。
- 同一原文得到不同结果:先检查 CAD 上下文、语言和术语冲突;短文本可能本来就需要人工决定。修正受控 CSV 后只重试相关范围。
- 把项目术语表删错或改坏:停止输出,从受控备份恢复 CSV;会话中已显示的译文并不能完整重建术语表版本。
- 不确定结果为什么被采用:先记录入口(Studio/插件)、该单元、语言和关联术语表;Studio 再检查 TM/CM 配置路径是否存在。不要把“来自记忆”解释为自动质量认证,也不要在插件入口假定 TM/CM 已加载。