翻译要求怎么写
把翻译要求写成本机翻译模型能稳定照做的样子。
概览
翻译要求是在翻译转录或对齐结果前填写的内容,不是与模型聊天。每项要求都会放进请求里的固定位置,本机翻译模型也是按这些写法训练的。按对应写法填,比写在别处稳定得多。
各项要求在哪里填:
- 只影响这一份结果。 打开顶部工具栏的语言选择器,点「更多翻译设置」。
- 新结果的默认值。 「模型 → 翻译 → 默认翻译设置」。
- 词典译法。 维护在词典里,入口是「编辑词典译法」。
每项要求的标题旁都有「怎么写」,点开是一句说明加一个示例。本页是展开版。
| 要求 | 出现条件 | 填什么 |
|---|---|---|
| 背景信息 | 始终 | 一两句话说明这段录音讲什么 |
| 翻译偏好 | 仅本机模型 | 最多 5 条短句,一条一个要求 |
| 词典译法 | 始终 | 一个开关,加词典里各语言的译法 |
| 翻译风格 | 始终 | 一个预设 |
| 保持标记格式 | 内容里检测到标签、键名或占位符时才出现 | 一个开关 |
| 自定义指令 | 仅商业模型服务 | 自由文本 |
背景信息
用来写什么。 内容本身没提及、但模型需要知道的信息:主题、说话人、场合,以及反复出现的名字。背景信息会放在原文前面作为参考材料,本身不会翻进译文。
怎么写。 用一两句陈述句说清内容。不要写成指令,也不要在背景信息里指定目标语言。长度预算约 1000 字,超出部分不会发送,界面也会提示。
推荐写法:
- 科技播客,两位主持人讨论端侧 AI 芯片。
- 视频剪辑软件的产品演示录屏,讲解时间线和导出面板。
- 大学宏观经济学课程录音,全程由授课教师讲授,中途有学生提问。
不要这样写:
| 写进背景信息的内容 | 为什么不合适 | 应该放哪 |
|---|---|---|
| 请把这段准确翻译成日语,顺便改掉错别字。 | 一句话里塞了指令、目标语言和模型不做的事 | 目标语言在语言选择器里选,错别字先在原文改 |
| GPU = 图形处理器,NPU = 神经网络引擎 | 这种对照会被当成待翻译的正文,不会当成术语表 | 词典译法 |
| 整份几页长的会议纪要 | 超出长度预算,后半截无法送达模型 | 只留主题、说话人和场景 |
翻译偏好
用来写什么。 贯穿整份结果、无法写成词条对照的规则:人名怎么处理、用第几人称称呼观众、数字怎么呈现。仅本机模型支持。
怎么写。 一条只写一个要求,用祈使短句,最多 5 条。偏好会以编号列表跟在原文后面,一条偏好对应一项编号任务。单条控制在中文 60 字、英文 30 词以内更稳定。写得过长,或一条里塞进多个要求,译文容易跑偏。
推荐写法:
- 人名保留英文。
- 操作说明一律用「你」称呼观众。
- 数字统一用阿拉伯数字。
不要这样写:
| 写成一条偏好的内容 | 为什么不合适 | 怎么改 |
|---|---|---|
| 人名保留英文,语气口语一点,产品名不要翻,句子别太长。 | 四个要求挤进同一项编号任务 | 拆成多条,产品名挪到词典 |
| 把原文的语病改掉,再润色得通顺些。 | 属于纠错和润色 | 先改原文,或改用商业模型服务 |
| 翻译成日语。 | 目标语言不是偏好 | 在语言选择器里选语言 |
词典译法
用来写什么。 人名、产品名和术语的固定译法。本批原文里出现过的词条,会以对照参考的形式放在原文前面。填了对应语言译法的词条按译法翻译,留空的词条保留原文不变,品牌名和型号就是这样保住原样的。
词典条目同时是转录热词,加进词典还能让这个词在转录阶段就识别得更准。
怎么写。 词条按它在原文里真实出现的形式填,一个词条一行,再逐个语言填入译法。需要保留原文的语言直接留空。
| 词条 | 英语译法 | 译文里的结果 |
|---|---|---|
| EdgeSpeak | 留空 | 保持 EdgeSpeak 不变 |
| 强制对齐 | forced alignment | 每次都译成同一个说法 |
| Lattice-2 | 留空 | 保持 Lattice-2 不变 |
整句话不要放进词典,通用规则也不要。「所有人名都保留英文」是一条翻译偏好,不是词条。
翻译风格
用来写什么。 译文的语体风格,如口语字幕或正式。选好预设后,模型会收到该风格的对应描述,并被要求严格遵守。
怎么写。 挑一个最接近实际用途的预设即可。不要在翻译偏好里重复写风格要求:预设用的是模型训练时见过的写法,比自己重述更管用。若要在预设之外补充要求,加一条短偏好就够了。
| 要翻译的内容 | 这样做 | 不要这样 |
|---|---|---|
| 准备配字幕的 Vlog | 选口语字幕预设 | 在偏好里写「语气轻松一点,像朋友聊天」 |
| 董事会会议录音 | 选正式预设 | 在背景信息里写「请用专业正式的语气」 |
| 字幕还要求人名保留英文 | 先选预设,再补一条偏好:人名保留英文。 | 把语体和人名规则挤进同一条偏好 |
保持标记格式
什么时候出现。 只有内容里包含 HTML 标签、JSON,或 {{name}}、${name}、%s 这类占位符时才出现。检测到此类内容且开关未开启时,界面会提示打开。
开启后做什么。 请求中会加入结构约束:原样保持数据结构、层级和缩进,只翻译面向用户显示的文字,不改标签、键名、属性名和变量占位符。
怎么写。 不用写,它是一个开关。不要在背景信息或翻译偏好里重复描述这些规则:开关发送的是模型训练时见过的写法,自己用文字重述效果反而更弱。
这些不要写在要求里
模型无法执行的要求不会报错,但会占满请求并把译文带偏。下列需求都有更合适的位置:
| 你想做的事 | 应该放哪 |
|---|---|
| 给名字、产品或术语定一个固定译法 | 词典译法 |
| 让某个词保留原文 | 词典译法,把对应语言留空 |
| 指定目标语言 | 顶部工具栏的语言选择器 |
| 顺手改掉原文里的错误 | 先改原文,翻译从改好的文字开始 |
| 润色、总结、扩写、加解释 | 商业模型服务 |
| 给两版译文,或附一段说明 | 做不到,每段只生成一份译文 |
| 原文和译文并排看 | 「对照」视图,以及导出时的排列选项 |
| 「结合上下文」「参考前文」 | 不用写,前文会自动带入 |
多数情况下,EdgeSpeak 会在输入时自动提示:词语对照写错了地方、背景信息里混进指令句、写的语言和已选语言冲突、要求的是本机模型不做的事。提示在停止输入后出现,不阻断翻译,也可以在当前结果里关掉。
本机模型与商业模型服务
| 本机模型 | 商业模型服务 | |
|---|---|---|
| 文本在哪里处理 | 端侧处理,离线可用 | 发送至你在 Providers 中配置的服务 |
| 语言 | 支持 38 种 | 取决于所选服务 |
| 背景信息、词典译法、翻译风格 | 支持 | 支持 |
| 翻译偏好 | 最多 5 条 | 换成自定义指令 |
| 自定义指令 | 无 | 自由文本,没有固定写法 |
| 纠错、润色、总结 | 不支持 | 取决于所选服务 |
自定义指令是自由文本,不受本页格式限制。但目标语言仍然在语言选择器里选,不要写进指令,免得两处冲突。
常见问题
译文里出现了「分隔符」「待翻译文本」这类字样。 字幕翻译会把多段合并成一次请求,并用分隔符对齐。每批都会做两项校验:分隔符数量与段数一致,且译文不能混入指令词。任一项未通过,该批次会自动退回逐段翻译,所以你很少会碰到。个别段落若仍出现此类字样,点「重试」或重新翻译该段。
粤语和繁体中文的用字自己变了。 中文译文写回前会统一转为繁体:粤语采用港式用字,繁体中文采用台湾用字,同时将中文后的半角标点转为全角。这一步对所有模型包一律执行。
背景信息能写多长?偏好能写几条? 背景信息按 token 估算,预算约 1000 字,超出部分不会发送。偏好最多 5 条,单条控制在中文 60 字、英文 30 词以内更稳定。
某段标了「译文待更新」。 通常由两种情况触发:翻译后原文被编辑、合并或拆分;或者修改了词典译法或任意一项翻译要求,此时该语言的所有译文都会标为待更新。点「更新译文」重新翻译单段,或点「翻译」按默认的「缺译文与待更新的段落」范围一次补齐。已校对的段落默认跳过,需要覆盖时开启「覆盖已校对的段落」。
写的要求好像没生效。 通常有三个原因:一条里塞了多个要求、单条写得太长,或要求了本机模型不做的事。把要求拆开、写短,术语移入词典,润色需求改用商业模型服务。