昨天,DeepSeek-V4-Flash 正式版 API 上线公测,不过暂时只能通过 API 体验,网页和 App 端尚未开放。从官方评测来看,Flash 正式版的性能已经超越 Pro 预览版和 GLM-5.2,逼近 Opus-4.8 的水平,进步相当惊人,也让人对 Pro 正式版的表现更加期待。

现在你可以在 Codex 中部署使用 DeepSeek-V4-Flash-0731,值得一试——这次 Flash 正式版专门针对 Codex 做了模型优化,能够显著提升 Agent 与编程场景下的表现。
在 Codex 上配置 Flash 正式版步骤非常简单。以 Mac 端的 ChatGPT App 为例(Codex 已集成在其中),你需要首先在 Mac 安装并登录 ChatGPT,确保能正常打开,因为不少用户会卡在登录验证这一步。
配置步骤:
-
打开终端,执行以下命令:
bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)
-
终端会显示操作选项,要求选择要配置的模型,这里输入 1 即可。

-
系统会提示输入 DeepSeek API Key。去 DeepSeek 开发平台 创建并复制 Key(需要先充值才能使用)。

完成以上步骤后,打开 ChatGPT,在模型选择中出现“自定义”选项,即表示配置成功。

接下来就可以在 Codex 中实际测试 Flash 正式版的编程与 Agent 功能了。
这次发布的 Flash 正式版,模型尺寸没有变化,但在工程层面大幅增强了代码与 Agent 能力。从评测得分来看,Flash 进步最大的是代码 Bug 修复能力,提升了将近 50 分;与 Opus-4.8 差距最小的是 Agent 与自动化能力,几乎追平,终端工具调用能力也非常接近。可见这次 Flash 的提升确实货真价实。

价格方面,Flash 正式版仍与预览版保持一致:输入 1 元 / M token,输出 2 元 / M token,比 Pro 预览版便宜约三分之一。而现在的 Flash 性能已经比 Pro 预览版强出一大截,并发速度更是 Pro 的 5 倍,性价比极高。

预计 Pro 正式版将在 8 月发布,后续还会有 DeepSeek 的第一个 Harness 应用,值得期待。
更多关于前沿模型与技术实践的讨论,欢迎来 云栈社区 一起交流。
|