文档翻译最怕两件事:术语前后不一致,以及译文带着明显的直译腔。讯飞星火在网页端和API都提供了文档翻译与内容润色能力,支持上传PDF、Word等格式,也能直接粘贴文本批量处理。下面拆解完整流程,重点说明如何设计提示词来让译文更自然。

文档翻译的三种入口与适用场景
网页端文档翻译入口最直接。登录讯飞星火官网,在工作台或智能文档模块找到文档翻译,上传文件,选择源语言和目标语言,点击开始翻译。网页版支持常见办公格式,但表格密集的PDF在转写时可能会出现单元格合并或内容错位,导出后需要人工校对。对于合同、报告这类格式要求高的文档,建议翻译后打开对比视图逐段检查。
复制粘贴方式适合短文档或临时段落。把文本放进对话框,直接说明“把下面内容翻译成英文,保留技术术语”即可。这种方式的优势在于可以随时追问和调整,比如要求换一种语气,或者把某个词改成更正式的表达。不过长文本直接粘贴容易超过单次处理上限,需要分段操作。
API方式适合需要批量处理或集成到业务系统的场景。通过星火开放平台申请APIKey,调用对话接口,把翻译任务封装成system消息和user消息,既可以一次性提交整段文本,也可以使用流式接口边生成边接收结果。下面是一段Python调用示例,开发者可以替换模型名称和提示词。
import requests
url = "https://spark-api-open.xf-yun.com/v1/chat/completions"
headers = {
"Authorization": "Bearer 替换为你的APIKey",
"Content-Type": "application/json"
}
payload = {
"model": "generalv3.5",
"messages": [
{"role": "system", "content": "你是专业文档翻译,把用户输入的中文翻译成英文,保留产品名称和单位。"},
{"role": "user", "content": "请翻译:本系统支持Windows与Linux平台,QPS上限为500。"}
]
}
resp = requests.post(url, headers=headers, json=payload)
print(resp.json())
中英文内容润色的关键步骤
润色不是重新翻译。翻译完成后,需要处理三类问题:直译痕迹、术语漂移、标点空格。针对英译中,常出现“被”“进行”“对于”等欧化句式;针对中译英,常出现主语缺失、冠词错误、介词搭配不当。润色时要把这些问题当成独立任务,而不是混在翻译指令里,否则模型容易顾此失彼。
第一步先明确润色目标,建议使用下面这个提示词模板。模板中给出了语言方向、应用场景和禁止事项,可以根据实际需求增删条目。将模板保存下来重复使用,可以避免每次重新组织语言。
请润色下面的文本。 语言方向:中译英 应用场景:软件产品说明文档 润色要求: 1. 保持原意,不添加或删除信息; 2. 统一术语,GP 统一翻译为 General Practitioner; 3. 不修改数字、单位、代码和函数名; 4. 输出正式、简洁的技术文档语气; 5. 如果原文有歧义,请在修改说明中标注。
分段润色时,每一段最好控制在1500到2500字之间,并在下一段开头重复上一段结尾的一两句话作为上下文。这样模型能保持语感和术语一致,防止因为上下文被截断而把同一概念翻译成不同表达。对于中英混合内容,还可以明确告诉模型“中文和英文、数字之间保留一个半角空格,但中文与标点之间不加空格”,这样可以减少后期排版工作量。
提高翻译与润色质量的实用技巧
术语表的作用比想象中更大。遇到重复出现的专业名词,比如品牌名、疾病名、硬件型号,可以在第一条消息中固定映射关系。不要只写“保持术语一致”,而要给出具体对应关系,例如“智能体不要翻译成agent,统一使用AI assistant”。这样模型在长文档中会稳定遵循同一规则,减少人工替换成本。
让模型给出修改说明是低成本的质量检查手段。润色完成后可以追问“请列出你做的关键修改和原因”。这能暴露模型是否把“不改变数据”误执行了,也能帮助后续人工复核。如果发现模型擅自省略了一段重要信息,可以要求它根据原文补回,并重新生成润色版本。
表格和列表优先用文本形式输入。如果直接从PDF复制表格,单元格顺序容易乱。可以先把表格转成“列名:值”的列表,再让星火翻译。例如原文表格三列,粘贴时可以写成“姓名:张三;年龄:30;职位:工程师”。翻译完成后,再按原结构还原。这样能显著降低表格错位概率。
最后做一次反向校验。把译文再翻译回源语言,和原文比对要点是否丢失。尤其是日期、金额、版本号、配置参数这些信息,容易出现数字被改写或单位被省略的情况。反向校验不需要逐字一致,但关键事实必须完全对应,这也是文档翻译和文学翻译的一个重要区别。