9 月 8 日,DeepSeek 放出了两条重磅消息。
第一条来自开发者群通知:V4.1 Flash 开启内测。新模型换上了全新架构,原生支持多模态看图能力,推理速度也更快了。

开发者只需保持 base_url 不变,把模型名换成 deepseek-v4.1-flash-expires-on-0910 即可调用。内测期间计费沿用老版 V4-Flash 价格,每个账号限流 20 并发。
顺便一提,从命名来看,这个临时内测端点应该会在 9 月 10 日到期下线。
第二条消息来自开放平台后台的官方站内公告:北京时间 9 月 10 日 12 点起,Flash 系列正式调价。

空闲时段缓存命中输入仅需 0.02 元/百万 token,缓存未命中输入 1 元,输出 4 元;高峰时段价格则直接翻倍。

这次降价最大的受益者,显然是 RAG 知识库和多轮对话类应用。凡是需要反复复用提示词的场景,API 调用成本可以直降六成。
这波降价,有网友调侃说"梁圣回来了"。


好了,我从滑动变祖器里截了张图:


整体来看,DeepSeek 这轮 Flash 调价延续了其一贯的性价比路线。对于大量依赖缓存命中的 开发者 来说,高峰与空闲分开计价的方式也给了更灵活的调度空间——预算敏感的业务完全可以错峰调用,进一步摊薄推理成本。
|