在HelloWorld里添加自定义术语通常在设置或术语库里完成:新建术语条目,填写源语词、目标语对应翻译、适用场景与优先级,保存后将词表应用到项目或团队;也可以通过CSV/JSON格式导入或用API批量上传并同步。启用后,平台在翻译时优先匹配这些术语,并支持大小写、词形变换和上下文例外配置,从而保证专业名词、品牌、专有名词在不同项目里始终一致。

为什么要在HelloWorld中添加自定义术语
先说为什么:日常翻译里词汇会有专业偏好、公司标准和品牌命名。机器翻译虽然越来越准,但默认会根据上下文生成不同翻译,同一个术语在不同文档可能被翻译成不同词。用自定义术语可以让输出统一、可控,减少反复校对和人工修正。
常见场景
- 跨境电商:产品名称、规格、品牌名需要一致
- 技术文档:专有术语和缩写要和团队约定保持一致
- 法律与合同:术语有法律效力要精准
- 营销与本地化:保留品牌语气或文化适配词
总览:添加自定义术语的三种路径
大体上有三种方式把术语加入 HelloWorld:手动在界面创建、通过文件导入(CSV/JSON)或用API批量上传。下面我按从易到难解释操作流程、注意事项和常见坑。
路径一:在界面里手动新增(适合少量术语)
步骤很直观,适用于需要即时添加单条或少量术语的时候:
- 打开设置 → 术语库/词表:不同版本界面名称会略有差异,但一般在“设置”、“资源”或“管理”里能找到“术语库”或“词表”。
- 选择新建术语:填入源语言词(原词)、目标语言翻译、*可选字段*包括词性、标签(如“产品名”、“法律术语”)、适用场景或备注。
- 设定优先级或匹配规则:有的平台支持“精确匹配/前缀/后缀/正则”,选择最适合的匹配策略以避免误替换。
- 选择作用范围:可以指定该术语仅对某个项目、某个团队或全局生效。
- 保存并同步:保存后通常有一个“同步”或“应用到项目”的按钮,确认后生效。
路径二:CSV/JSON导入(适合数百到数千条)
当术语条目较多时,手工录入非常慢。这时用CSV或JSON导入是常规选择,关键是格式要对。
| 常见CSV列头 | 示例说明 |
| source | 原始词条(必填) |
| target | 目标语言翻译(必填) |
| lang_pair | 语言对,例如 zh→en(可选,或由目标语言列表示) |
| tag | 词条标签,如 PRODUCT/LEGAL(可选) |
| priority | 优先级,数值越大优先级越高(可选) |
| match_type | 匹配类型,如 exact/prefix/regex(可选) |
示例CSV内容(逗号分隔):
source,target,lang_pair,tag,priority,match_type
“小米手机”,“Xiaomi Phone”,zh→en,PRODUCT,100,exact
“云服务器”,“Cloud Server”,zh→en,TECH,90,exact
注意事项:
- 确保文件编码为UTF-8,避免导入后出现乱码。
- 先在小规模上测试导入效果,确认匹配规则没有误伤普通文本。
- 如果平台支持,先导入到“草稿”或“测试词库”,验证后再切换为“生产”词库。
路径三:通过API批量上传(适合自动化和持续集成)
当你希望把术语管理纳入流水线(例如一有新产品就自动同步),API是最合适的方式。基本流程:
- 申请API Key并确认权限(术语写入权限等)。
- 按HelloWorld API文档要求构造请求体,常见字段与CSV类似:source、target、lang_pair、priority、tag、match_type。
- 实现幂等上传:用唯一ID(如source+lang_pair)避免重复创建。
- 错误处理和回滚:API通常返回批量操作的结果,记录失败条目并在日志里标注。
匹配规则与优先级细节(关键点)
说得再清楚点,术语库生效时,翻译引擎会按规则筛选:先按优先级、再按匹配精确度、最后按上下文例外。理解这三步能避免很多问题。
1. 优先级(Priority)
设置数值越高越优先。如果你有“品牌名”与“普通词”冲突,给品牌名更高优先级。注意不要把所有术语都设为最高,这样无法区分重要性。
2. 匹配类型(Match type)
- Exact(精确):完全相同才替换,最安全。
- Prefix/Suffix(前缀/后缀):匹配词首或词尾,适合复合词。
- Regex(正则):最灵活,但容易误伤,需要测试。
3. 上下文例外与词形变换
有时你想在特定上下文不替换,或允许大小写/复数形式也被匹配。好的术语管理会提供“例外短语”和“变形规则”字段,用于指定这些情况。比如“apple”作为品牌时保持不翻译,但在“apple pie”里可能需要翻译为“苹果派”。
测试、验证与持续维护
添加之后别以为完事了。术语库是活的,需要持续维护。下面是一个推荐的周期性流程:
- 添加或导入后先在小批量文档上启用测试模式,检查误替换。
- 收集团队反馈,记录误伤和漏替换条目并调整规则。
- 定期(如每月或每个版本)清理不再使用或已废弃的术语。
- 对不同语言对单独优化,因为翻译习惯和词形变化不同。
质量检查要点
- 一致性:相同源词在不同文档是否被统一替换?
- 准确性:目标词是否符合行业规范或公司风格?
- 覆盖率:关键术语是否都被包含?
- 安全性:是否有词条会泄露敏感信息或违反合规?
协作与权限管理
在团队环境里,通常需要多人参与术语维护。HelloWorld一般提供团队词库和权限控制:
- 管理员可以创建和批准词条;审校员可以建议修改;翻译者可以使用但不得直接覆盖高优先级条目。
- 变更记录:启用版本控制或变更历史,便于回滚。
- 审批流程:对重要术语设置审批流程,避免未经审查就影响大量文档。
一些实战技巧(来自常见问题)
- 先少量多次测试:尤其是正则匹配,先在测试集上跑十篇左右,看看有没有误判。
- 用标签组织:按产品线、文档类型、或优先级打标签,便于筛选与导出。
- 注意大小写处理:设计匹配时决定是否要忽略大小写,或为大小写创建独立条目。
- 编码与格式:CSV请用UTF-8并带BOM(视平台要求),JSON请用标准UTF-8无注释格式。
- 自动化同步:把术语文件纳入代码仓库或内容仓库,结合CI在发布时自动同步。
可能遇到的问题与解决办法
导入后没有生效
- 排查编码、列头是否匹配平台要求,确认语言对是否正确。
- 检查是否需要“应用到项目”或“启用词表”这类二次操作。
术语被错误替换
- 改为精确匹配或加上下文例外。
- 降低优先级,或添加更具体的替换规则。
多人修改冲突
- 建立审批流程与版本控制,要求变更时填写变更原因。
示例流程汇总(快速参考)
下面是一个可复制的操作流程,适合中小团队:
- 由产品或本地化经理整理术语清单,导出为CSV。
- 在HelloWorld的测试词库里导入CSV,进行小规模测试。
- 收集团队反馈,调整匹配规则与优先级。
- 审批通过后将词库切换到生产并应用到对应项目。
- 将CSV纳入版本控制,建立周期性复核计划。
好了,这些是我在实践中常用的步骤和注意点,可能还有一些平台特有的按钮和文字你会在界面里发现:比如“启用术语保护”“忽略大小写”等选项,遇到时就按上面的原则去判断和试验。操作起来其实不会太复杂,多做几次就熟练了,团队里有了标准化流程之后,翻译质量稳定得很。祝你把词表搭好,省下很多反复校对的时间——有问题了再边查边改就行。