Codex是我现在经常使用的AI工具。
写程序、修改文件、制作一些小工具,包括电脑遇到问题时排查原因,我都会让它来帮忙。
不过,Codex默认使用的是OpenAI的模型。最近我发现,DeepSeek官方已经给出了接入Codex的方法,可以把DeepSeek-V4-Flash直接放进Codex中使用。
而且这次不需要我们自己研究复杂的配置文件,官方已经准备好了一键脚本。
运行脚本、选择模型、填入API Key,重新打开Codex就能用了。


最关键的是——性价比高,花费非常非常低。
准备API Key
首先打开DeepSeek开放平台:https://platform.deepseek.com/api_keys
登录以后,进入API Keys页面,新建一个API Key。


创建成功后要立即复制保存,因为完整的Key只会显示一次。如果忘记了,就只能删除后重新创建。
这里也要提醒一下:API Key相当于账号的使用密码,不要透露给任何人。
DeepSeek API采用按量付费的方式,需要先给账户充值少量余额。平时个人使用究竟花费多少,和任务数量、输入文件大小以及模型输出长度都有关系。总体来说,非常便宜,再加上缓存,性价比非常高。


一条命令完成配置
在已经安装了Codex的Windows 10以上的电脑中,先打开PowerShell。
可以按下Win+x,打开终端。


接着复制DeepSeek官方提供的命令:
irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex
粘贴到PowerShell中,按下回车键运行。


使用前有一个前提:电脑上需要已经安装并至少运行过一次Codex CLI或者Codex桌面端。只有运行过以后,电脑中才会生成.codex配置目录。
脚本运行以后,根据提示选择DeepSeek-V4-Flash,再粘贴刚才创建的API Key。


这个脚本会自动备份原来的Codex配置,再写入DeepSeek模型信息。原来已经配置的MCP、项目权限等内容会被保留。如果配置文件存在错误,脚本也会停止写入。


比起自己打开配置文件逐行修改,这种方式显然更适合普通用户。
重新打开Codex
配置结束以后,关闭并重新打开Codex。模型名称有时会直接显示为DeepSeek-V4-Flash,有时只显示“自定义”。只要前面的配置正确,“自定义”背后使用的就是DeepSeek模型。


接下来就可以安排一个实际任务了。
比如让它读取一个项目、修改一段代码,或者根据自己的需求制作一个简单工具。


我磁盘又红了,让它帮我看看哪些可以清理。平时放的很多文件,扔那里没管就忘了,AI能很轻松找出来。
以前的对话怎么不见了
切换模型以后,可能会遇到一个容易吓人的情况:以前在Codex中的对话记录看不到了。
这些记录并没有被删除。
Codex会按照登录方式显示不同的会话。恢复原来的配置并重启客户端,之前的会话就会重新出现;这时DeepSeek下的会话又会暂时隐藏。
如果想切回原来的模型,可以再次运行官方脚本,在菜单中选择恢复配置。
所以,切换前最好先完成手头正在进行的任务,不要看到会话突然“消失”就以为数据被删掉了。
解决识别图片的问题
接入完成以后,还有一个明显的限制。
DeepSeek-V4-Flash是纯文本模型,不能直接识别图片。
如果把软件截图、报错窗口或者网页设计图交给它,它并不知道图片里有什么。这不是哪里设置错了,而是这个模型本身没有识图能力。
但是,Codex的很多任务又离不开图片。
比如你可能经常需要把一张截图发给codex,然后问它是怎么回事,让他帮忙解决。主模型不能看图,我们可以另外给它安排一个专门负责识图的模型。
简单来说:DeepSeek负责思考和干活,视觉模型负责把图片理解成文字,再把结果交给DeepSeek。
给Codex补上识图
我们需要使用一个开源的视觉Skill,让codex后续在收到图片后都用这个skill来理解图片。
同时,需要为它配置识图的大模型,我建议使用:Doubao-Seed-2.0-lite,去火山方舟平台生成一个key即可,和DeepSeek生成key一样,就不再多赘述了。
现在有codex了,让它帮我们安装skill和配置识图大模型,不需要亲自动手了。
告诉Codex:
请在codex全局给我安装下面开源的skill:https://github.com/asuojun/claude-vision-skill
安装完成后,读取README.md,帮我配置识图。视觉服务使用火山方舟,模型使用Doubao-Seed-2.0-lite。
接口地址:https://ark.cn-beijing.volces.com/api/v3/responses
模型名字:doubao-seed-2-0-lite-260428
key:【填你的key】
安装完成以后,可以给Codex一张本地图片,要求它说明图片中的内容,或者根据界面截图修改程序。


如果它能够先给出正确的图片描述,再根据描述继续完成后面的任务,就说明这套识图流程已经正常运行。
理解图片,不是单纯的OCR,OCR是只能提取里面的文字。
如此,你的codex便拥有了理解图片和执行任务的能力,这两个大模型的费用都非常低,充10块钱都能用很久了。
最后
这次DeepSeek官方直接给出了Codex的一键配置脚本,接入过程已经简单了很多。
如果平时主要让Codex处理文字、代码和本地文件,只配置DeepSeek-V4-Flash就可以了,没有必要为了一个暂时用不到的功能继续折腾。
确实需要处理截图和界面设计时,再安装视觉Skill,让Doubao-Seed-2.0-lite负责理解图。
一个负责思考和执行,一个负责看图,组合起来就完整多了。
- end -