PDF翻译工具对比的原文给了 7 款工具和一张快速决策表,真到自己要选的时候,免费、保真、小语种三个条件还是会在脑子里打架。TaoToken 的官网 https://taotoken.net/?utm_source=taotoken_aicg_blog_end&utm_content= 可以解决的不只是额度问题:拿一把 Key 填进 Codex 的 base_url,把原文那张快速决策表改写成提示词,Codex 就会按“完全免费、排版保真、支持中文”输出一份排序清单,省掉人肉比对七段推荐理由的时间。
1. 原文决策表的问题:免费、保真、小语种三个条件互相打架
原文那份 7 款 PDF 翻译工具对比,单看每一款的推荐理由都成立:PDF Translator.org 连 Gemini 和 ChatGPT 双引擎都能免费用;沉浸式翻译的 BabelDoc 能把双栏论文像素级还原;DeepL 的译文自然度被公认为天花板;福昕强在长文档不卡顿;Google Translate 语种覆盖超过 100 种;知云在国内学术圈用的人最多;PDNob 则胜在文件不出本机。问题在于,真实需求从来不是“哪款最好”,而是“在完全免费、排版保真、支持中文这三个条件同时成立时,哪几款能留下来”。
1.1 七款里真正完全免费的没想象中多
把原文的价格信息摊开看:PDF Translator.org 完全免费,无隐藏收费;沉浸式翻译完全免费,免费用户每月有 50 万 Token 额度;Google Translate 文档翻译完全免费。这三款的免费是没条件的。DeepL 虽然有免费版,但单文件限制在 5MB、最多 10 页,翻一篇带图表的论文可能直接超出页数;福昕翻译大师网页版基础翻译免费,可一旦要排版保持、双语译文和 AI 模型翻译,就得开 88 元/月的超级会员;知云基础功能免费,但划词翻译之外的高级功能要走最低 98 元的 VIP;PDNob 则从头到尾是付费软件,一年约 29.99 美元。
这还没算排版保真度。Google Translate 走 Google Docs 间接翻译,版式能保留一部分,但遇到分栏、公式、图片说明,效果和 BabelDoc、PDF Translator.org 的图层级解析有明显差距。人眼要同时比对“免费程度”和“保真度”两个维度,就得把七段推荐理由来回读三遍。
1.2 决策表适合按场景查,不适合按条件筛
原文最后给的快速决策表是按场景组织的:要免费且保真选 PDF Translator.org,要阅读效率选沉浸式翻译,要译文质量选 DeepL,要长文档选福昕,要小语种预算为零选 Google Translate,要精读选知云,要保密选 PDNob。这个表已经很好用了,但它默认读者知道自己的场景属于哪一类。如果你反过来问:“我就一个条件,必须完全免费,同时中文支持要好,排版别乱,剩下 7 款里哪几款能打?”这张表就没有现成答案,需要你自己重新归纳。
这种“换条件重新排优先级”的工作,正好可以交给 Codex 做。我在 TaoToken 拿了一把 Key,把 Codex 的 Base URL 指向其 API 通道,再把原文的快速决策表整理成提示词,几十秒就得到一份按免费方案排序的新清单。
2. 先到 TaoToken 拿 Key,模型 ID 以模型广场为准
要让 Codex 替你筛 PDF 翻译工具,第一件事不是写提示词,而是先把调用通道准备好。TaoToken 提供的是统一 API 接入,注册、创建 Key、看模型广场和用量都在官网完成;真正填进 Codex 的 Base URL 则是接口地址,两者不要混用。Codex 本身不产生额度,你问它的每一次分析,消耗的都是 TaoToken 上所选模型的额度。
2.1 注册并创建 API Key
打开 TaoToken,注册登录后进入控制台,在 API Keys 页面创建一把新 Key。创建后把 Key 复制下来保存,后面填到 Codex 的环境变量里。全文涉及 Key 的位置都用 YOUR_API_KEY 占位,真实值只有你自己看得到。
2.2 模型 ID 从模型广场确认
Codex 配置里需要写一个 model ID。不同时期的模型广场列表可能不一样,配置前先到 https://taotoken.net/?utm_source=taotoken_aicg_blog_end&utm_content= 的模型广场确认当前可用的模型,再把对应的模型 ID 填进配置。不要照抄网上过期教程里的模型名,也不要自己猜一个带日期的后缀,以模型广场当时列表为准。
3. 用 ~/.codex/config.toml 把 Codex 指向 TaoToken
Codex 的配置方式是在用户目录下维护一个 config.toml。我们要做三件事:声明一个名为 taotoken 的模型供应商,把 base_url 指向接口地址,把 API Key 通过环境变量传给 Codex。
3.1 config.toml 完整写法
编辑 ~/.codex/config.toml,写入以下内容:
model = "YOUR_MODEL_ID" model_provider = "taotoken" [model_providers.taotoken] name = "TaoToken" base_url = "https://taotoken.net/api" env_key = "TAOTOKEN_API_KEY" wire_api = "chat"注意 base_url 填的是 https://taotoken.net/api,末尾不要加 /v1;YOUR_MODEL_ID 替换成模型广场上查到的模型 ID;env_key 是 Codex 读取 API Key 时用的环境变量名,我们指定为 TAOTOKEN_API_KEY,下面导出环境变量时两个名字要保持一致。
3.2 导出环境变量并验证通道
在终端里导出环境变量:
export TAOTOKEN_API_KEY=YOUR_API_KEY然后先跑一句最简单的对话确认通道通不通。直接在 Codex 里问:“请用一句话说明你当前可用的模型能力。”如果它正常回答,说明供应商配置、环境变量和模型 ID 都正确。这一步不要跳过,通道没验证就开始筛工具,遇到报错会分不清是配置问题还是提示词问题。
4. 把原文快速决策表改写成筛选提示词
通道准备好了,接下来把原文 7 款工具的信息整理成一段结构化提示词。重点不是把每款工具的优点抄一遍,而是让模型在同一组约束条件下排序。以下模板可以直接复制使用。
4.1 提示词模板
我有一份 PDF 翻译工具的对比资料,共 7 款:PDF Translator.org、 沉浸式翻译、DeepL、福昕翻译大师、Google Translate、知云文献翻译、 PDNob。各款与免费、排版、语言相关的关键信息如下: - PDF Translator.org:完全免费,支持 100 多种语言互译,能保留表格、 图片、公式和多栏排版,支持双语对照,单文件上限 20MB。 - 沉浸式翻译:完全免费,免费用户每月 50 万 Token 额度,通过 BabelDoc 还原双栏论文和图文混排合同,支持本地 AI 处理。 - DeepL:译文自然度公认最高,免费版单文件限 5MB、最多 10 页, Pro 版约 10.49 美元/月。 - 福昕翻译大师:不用注册,基础翻译免费,排版保持、双语译文和 AI 大模型翻译需要会员,超级会员 88 元/月。 - Google Translate:完全免费,支持 100 多种语言,配合 Google Docs 能保留大部分版式,单文件上限 10MB,小语种覆盖广。 - 知云文献翻译:国内学术圈常用,基础功能免费,支持划词翻译和 文档翻译,高级功能 VIP 最低 98 元。 - PDNob:本地离线处理,OCR 识别后再翻译,适合敏感文档, 付费软件,约 29.99 美元/年。 请按三个条件筛选:第一,完全免费或免费额度足够日常使用; 第二,翻译后 PDF 排版保真度高;第三,支持中文输入输出。 输出一张 Markdown 表格,按“适合直接上手”的顺序排序, 每行包含工具名、免费程度、排版保真、中文支持、一句话适用场景, 最后用一段话说明排序理由。4.2 把条件写死在提示词里
有人习惯在对话里补一句“只要免费的那些”就完事,但这样得到的答案往往模棱两可:DeepL 有免费版到底算不算免费?福昕的基础免费算不算?把“完全免费或免费额度足够日常使用”写清楚以后,模型会按统一口径筛选。第二个条件“排版保真度高”同样关键,否则 Google Translate 这种版式一般但免费的选项会被排到前面,实际用起来却对不起这个位置。
5. 按免费方案排序的结果:PDF Translator.org 排第一
按上面提示词跑完后,Codex 给出的排序基本稳定在这条线上,前提是模型广场上可用的模型推理正常。
5.1 预期输出清单
第一梯队是 PDF Translator.org 和沉浸式翻译。PDF Translator.org 因为完全免费、支持 100 多种语言、排版保留完整还带历史记录,综合评分最高;沉浸式翻译的 BabelDoc 在处理双栏论文时保真度极佳,免费额度也够日常用,排在第二。Google Translate 排第三,它胜在完全免费、语种覆盖广,但排版保真度一般,适合快速了解 PDF 内容大意,不适合直接交付。DeepL 排在第四,免费版限制在 5MB/10 页以内,小文件可以直接用,正式场景建议走付费。福昕靠免注册加长文档稳定排第五,但排版保持和 AI 翻译要会员。知云适合学术精读和划词翻译,排第六。PDNob 因为是纯付费且主打本地隐私保护排最后,但涉及商业机密的文件它反而是首选。
如果你经常翻译专业文档,可以沿用原文的小贴士:正式处理重要文件前先用非关键文档试译,确认表格、公式和图片说明的还原效果;术语一致性要求高时,优先用带术语库功能的 DeepL、沉浸式翻译,或者 PDF Translator.org 的风格选择功能。
5.2 让 Codex 解释排序依据
如果对某个排序有疑问,可以直接追问:“请结合每款工具的价格和排版保留能力,解释为什么 DeepL 排在 Google Translate 后面。”Codex 会列出版式保留和免费额度的对比。这一步相当于把原文的快速决策表变成一份可交互的选型报告,换任何一个条件组合都可以重新问一遍。
6. Codex 调用核验与两种典型报错
Codex 跑完筛选后,建议回控制台确认这次调用确实记到了 TaoToken 的用量里。完整流程是:先到 TaoToken 创建 Key,把 Base URL 填成 https://taotoken.net/api,让 Codex 按条件筛原文 7 款工具,最后回官网看用量。
6.1 401 认证失败
如果 Codex 返回 401 或提示认证失败,先检查 TAOTOKEN_API_KEY 是否导出成功,以及 config.toml 里的 env_key 是否和导出变量名一致。另一个常见原因是 Key 复制时多了空格或者漏了后半段,重新创建一把 Key 再试。
6.2 模型 ID 与模型广场不一致
如果报错里带 model not found 或类似的模型 ID 提示,说明 config.toml 里的 model 字段和模型广场列表对不上。回到 https://taotoken.net/?utm_source=taotoken_aicg_blog_end&utm_content= 的模型广场复制当前模型 ID,粘贴到配置里,不要手工照敲。
6.3 回控制台核对这次调用
配置跑通后,建议先去 TaoToken 模型对话 用同一把 Key 发一条测试消息,确认模型 ID 和 Base URL 在交互界面里也没问题。如果打算长期让 Codex 做选型分析和代码任务,可以打开 Coding Plan 看套餐额度;Key 随时在 控制台 API Keys 创建。正在用 Claude Code 的读者也可以对照 接入文档 里的环境变量写法,把同一把 Key 用到多个工具上。