本文整理自B站「DeepSeek V4 Flash 接入 Codex 教程(可识图)」,通过音视频转笔记工具Ai好记转录整理,以下为精炼整理后的内容。
DeepSeek V4 Flash 正式版发布了。这次更新有两个关键信息:一是 Terminal Bench 达到82.7,工具调用能力大幅提升;二是原生支持 Responses API 格式,并针对性适配了 Codex。换句话说,你现在可以用比较低的成本,把 DeepSeek V4 Flash 接入 Codex,享受顶级 AI 编程助手的体验。
DeepSeek V4 Flash 正式版有什么变化
先看一下这次更新的核心指标。Terminal Bench 达到82.7,这个数字在同类模型里相当亮眼。Terminal Bench 主要衡量的是模型的终端能力——调用工具、执行命令、处理复杂任务链。对于 Agent 场景来说,这个指标直接决定了模型在编程助手里的靠谱程度。
更关键的是,正式版 V4 Flash 原生支持了 Responses API 格式,并针对性适配了 Codex。之前 DeepSeek 主要适配的是 Claude,现在 Codex 也进入了一等公民的行列。考虑到 Codex 最近跟 GPT 客户端合并、用户量持续增长,这个适配来得正是时候。
接入准备:三个工具,一个账号
开始之前,你需要准备好以下东西:
1. 下载 Codex
Codex 和 GPT 客户端已经合并,去官网下载就行。Windows 和 Mac 都有对应版本。
下载后先不用登录,甚至不用注册 GPT 账号。后面通过配置工具接入,不需要走官方订阅。
2. 获取 DeepSeek API Key
进入 DeepSeek 开放平台(从官网点「开放平台」进去),新建一个 API Key。
注意:API Key 创建后只能看一次,创建完立刻复制保存到备忘录里,别弄丢了。
3. 下载 CC Switch
CC Switch 是一个统一管理 AI 编程工具工作流的配置工具,GitHub 上已经积累了12万+ star。它能配置 Codex、Claude 等多种编程助手,支持 DIY 接入各种模型。
如果你不想走官方订阅,或者没有条件走官方订阅,CC Switch 就是你的必经之路。
配置步骤:三步搞定
第一步:在 CC Switch 中配置 DeepSeek
打开 CC Switch,点击右上角的加号,添加 Codex 供应商。往下拉找到 DeepSeek,选择它。
在 API Key 栏填入刚才从 DeepSeek 开放平台获取的 key,点测速确认没问题。测速通过后,点击启用。
第二步:重启 Codex 加载配置
配置好之后,需要重启 Codex 让它加载 CC Switch 的配置。注意:如果你之前登录过 Codex,重启后历史会话会被清掉,因为走的是不同的配置通道。
重新进入 Codex 后,你会看到模型标识变成了自定义,说明已经接通 DeepSeek 了。
第三步:验证接入是否成功
随便发一条消息测试一下,能正常回复就说明接入成功了。到此为止,你已经用上了 DeepSeek V4 Flash 驱动的 Codex。
进阶:让 DeepSeek 获得识图能力
接入之后你会发现一个问题:DeepSeek 虽然官网宣称有多模态能力,但实际在 Codex 里是看不到图片的。截个图问它「这是什么」,它会尝试提取文字但读不到图片内容。
怎么办?方案是蹭云平台免费的视觉模型,通过一个 Skill 来桥接。
用 Claude Vision Skill 做视觉桥接
在 Codex 中安装一个叫 Claude Vision Skill 的插件。虽然名字带 Claude,但它是一个通用方案——让 non-vision models 也能获得看图能力。
安装方式很简单,直接在 Codex 里让 AI 帮你装就行。
获取免费的视觉模型 API
推荐使用阿里云百炼平台上的千问模型。选择千问3.7 Flash 2026这个版本,复制它的模型 Code。
同时在百炼平台创建一个 API Key(描述可以写 Codex),复制保存。
让 AI 帮你配置环境
把阿里云百炼的 API Key 和模型 Code 告诉 Codex 里的 AI,让它帮你配置好环境变量。AI 会自动完成配置,并用真实图片调用 API 验证。
配置完成后,Skill 会在下一轮对话中自动生效。
验证多模态能力
开一个新会话,发一张没有文字的纯图片(比如某个 App 图标),问它「这是什么」。
如果配置成功,你会看到它自动调用了 Claude Vision Skill,正确识别出图片内容。比如:这是一张 App 应用图标的截图,背景是模糊的金棕色桌面,图标是某某应用。
到此,你就用比较低的成本,让 DeepSeek V4 Flash 驱动的 Codex 获得了识图能力。
总结
这套方案的核心思路是:用 DeepSeek V4 Flash 的 API 做推理引擎(性价比高),用 CC Switch 做配置管理,用阿里云百炼的免费视觉模型做多模态桥接。三个组件各司其职,最终实现了一个低成本、可识图的 AI 编程助手。
DeepSeek V4 Flash 正式版在工具调用和 Agent 场景下的表现值得期待,加上 Codex 越来越完善的生态,这套组合的实用价值会越来越高。
以上内容由Ai好记转录整理。Ai好记 是一款音视频转图文笔记的 AI 学习助手,支持 B站、抖音、小宇宙等平台链接及本地音视频文件,转入后自动生成精华速览、思维导图和结构化笔记,帮助你把几小时的视频内容变成可搜索、可复习的图文笔记。