批量翻译文档,听起来就让人感到头疼——面对几十份PDF、Word和Excel文件,需要一次性翻成德语、日语、西班牙语,还要保留原始格式?很多人第一反应是找个在线工具,然后逐个上传、重复点选、手动下载。但Codex偏偏把这条路走通了:直接在本地的项目里调度翻译任务,跳过网页跳转,也不用担心格式错乱。

简单来说,Codex能直接处理你本地文件夹里的文档,而不是让你在网页端一个个折腾。操作流程其实就三个环节:准备文件、触发任务、坐等结果。下面逐一拆解说明。
文档准备与语言配置
第一步很简单:把所有待翻译的文档(.docx、.pdf、.xlsx)统一放进一个空文件夹。比如,你可以命名为“待译_合同_202606”。这里有个硬性要求:文档必须平铺在根目录下,Codex不识别嵌套子文件夹里的内容。
文件夹搞定后,打开Codex App,点击左下角的“+ New Project”,选择这个文件夹作为工作区。首次加载时,系统会自动索引所有文档,等右上角显示“37 files indexed”之类的提示,就说明一切就绪了。
触发批量翻译任务
有两种方式启动翻译任务,看你的偏好和具体场景。
方法一:用自然语言指令启动
在对话框里直接说一句:“请将当前项目中所有文档翻译为德语、日语和西班牙语,保留原始格式,输出为同名新文件,加后缀_lang,比如report.docx → report_de.docx。” 然后确认AI理解了你的上下文,它会返回一个执行摘要,包括预计耗时、文件映射表以及术语处理策略。看到这些信息后,输入“确认执行”,Codex就会调起内置翻译引擎开始干活。
方法二:用CLI命令行精准控制
如果你处理的是一些含有敏感术语的合同,用命令行会更稳妥。切换到终端面板,运行:codex translate --files "*.docx,*.pdf" --target de,jp,es --preserve-layout --glossary ./terms.json。需要特别留意的是:如果没有提供terms.json,系统会跳过术语校准,专有名词可能被误译。
监控与获取结果
任务启动后,可以边喝茶边看进展。左侧的“Activity Log”面板会实时刷新每个文档的处理状态,绿色对勾表示格式无损导出成功。翻译中如果遇到扫描图像页,Codex会自动调用OCR模块识别文字,但手写体或者低分辨率图片还是可能漏字,这时候得去对应的_output文件夹里翻一翻*_ocr_fallback.txt,人工复核一下。
等全部完成后,打开项目文件夹里的“output/translations”子目录,所有目标语言文件已经按规则生成好了,命名清晰,双击就能用原生软件打开验证。
