对于翻译公司(LSP)或者企业的内部本地化团队而言,在开始翻译一本上百页的工程手册或医疗报告之前,最重要且最耗时的工作是什么?
答案是:建立术语表(Glossary / Termbase)。
在长篇文档甚至多个文档并行的翻译项目中,“统一口径”是关乎质量的命脉。如果第一页把某个核心零件翻译为“主板”,第五十页翻译成“母板”,不仅会造成读者的困惑,如果是法律合规或医疗类文档,甚至会导致严重的安全事故。
传统手工建立术语表的痛楚
过去,建立术语表的流程被称为“术语提取(Term Extraction)”,通常由资深译员或项目经理手动完成:
- 通读上百页的合同、手册、画册、报告或其他复杂文档。
- 凭借经验,将反复出现的新词、缩写、专有名词、设备型号等用荧光笔高亮。
- 复制这些词,粘贴到 Excel 中,再花大量时间查找标准释义,最终生成一个由几十个词构成的词汇表供所有译员参考。
这项工作极其依赖人工经验,不仅可能耗时数天,还容易漏掉反复出现的重要术语,或者把只出现一次的标题和普通短语一并塞进术语表。一份真正可用的术语表,并不是条目越多越好,而是既要保留有价值的词,也要控制噪音。
SimplifyAI 的翻译前智能分析(Pre-Translate Analysis)
真正的 AI 翻译并不是盲目地把整本书塞进大模型,而是应该具备类似资深翻译专家的“预审阅”能力。
在 SimplifyAI,系统会在正式翻译前先完成一次翻译前分析(Pre-Translate Analysis),帮助您提前发现并整理文档中的关键术语。
第一步:全文档云端扫描
上传长篇文档后,系统会先分析文档内容并提取需要翻译的文本。纯数字、URL、代码占位符等无需翻译的片段会通过另一套规则处理,避免它们污染术语候选。
第二步:智能术语抽取(Term Extraction)
系统会结合文档上下文,识别可能需要统一翻译的行业概念、产品名称、缩写和重复出现的短语。
出现次数是重要信号,但前提是统计的是完整词语本身。例如,OXYGEN 中包含 OXY,并不代表文档真正使用了一次 OXY。SimplifyAI 会结合整词出现次数、上下文和词语类别进行判断,而不是把每次子串匹配都算成该术语。只出现一次的普通短语通常不会进入最终术语表,以免挤占更有价值的条目。
抽取出的候选会按使用方式分层:
- 核心术语(Core Terms):置信度较高,确认后的译法需要严格使用。
- 一致性短语(Consistency Phrases):值得保持统一,但属于软偏好,可以根据目标语言的语法自然变形。
- 低置信度候选(Lower-confidence Candidates):价值较弱的建议,与核心术语分开,留待审阅。
术语分层和“不翻译内容”是两件事。纯数字、URL 和代码占位符可以原样保留,但它们不属于第三类术语。
第三步:生成“可确认”的翻译计划(Pre-Translation Plan)
这一步的关键在于:术语在翻译前可以先被“确认”,而不是等全文翻完才发现术语不统一再返工。 系统会根据抽取出的候选及其文档上下文,自动生成目标语言的初步译法。此时主翻译任务尚未开始,您可以审阅 AI 生成的术语表,修改建议译法、拒绝不需要的条目,也可以手动补充术语。
第四步:在翻译中保持术语一致
确认术语表并点击“开始翻译”后,系统会在后续翻译中持续参考这份术语表。核心术语会受到更严格的译法约束;一致性短语则作为优先译法,在目标语言需要单复数、格、冠词或其他语法变化时允许自然变形。
对于屈折变化丰富的语言,这种区别尤其重要:保持术语一致,不应该迫使一个语法正确的句子机械地使用同一种表面形式。人工添加的术语仍会严格执行,因为这些译法是审阅者明确指定的。
高效、一致、专业
自动术语抽取技术,可以显著缩短翻译项目准备期(Preparation),也能减少翻译完成后因为术语不一致带来的返工。
对于追求准确度和一致性的 B 端客户而言,把术语整理前置到翻译开始之前,往往比事后逐页返修更可靠。您可以将复杂源文件上传到 SimplifyAI,先让系统生成一份可审阅、可调整的术语建议。