找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

5694

积分

0

好友

721

主题
发表于 4 天前 | 查看: 13| 回复: 0

刚刚,DeepSeek 在 API 平台发布了一则公告:

V4.1 Flash 正式上线后,所有原本发往 V4 Pro 的请求,都会全部路由到 V4.1 Flash,并按照 V4.1 Flash 的价格计费。

DeepSeek API 平台公告截图:V4.1 Flash 将全面接管 V4 Pro 请求

官方给出的理由非常直白:

经过内部和外部测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上,已经全面超过 V4 Pro。

也就是说,DeepSeek 不是让 Flash 和 Pro 并存一段时间慢慢过渡,而是准备直接让 Flash 接管 Pro 的全部流量

一个 Flash 模型,把上一代 Pro 直接替掉了。这下 V4 Pro 基本可以提前退休了。

以往厂商更新模型,最常见的操作是:

  • 新老模型并存
  • 给用户充分迁移时间
  • 生怕把已经调好的提示词和工作流弄崩

DeepSeek 这次却选择了更激进的方式。官方的核心判断很明确:继续用更高价格、更慢速度、更多算力去服务一个已经全面落后的模型,对用户并不合适。

所以干脆一步到位:请求全部路由到更强的 V4.1 Flash,价格还按更便宜的 Flash 标准收。

对用户来说,短期收益非常直观:

  • 速度更快
  • 费用更低
  • 综合性能更好

对 DeepSeek 来说,也能把算力资源更高效地集中到新架构上。

有人兴奋地直呼“太香了”,实测速度轻松跑到 300+ tokens/s,有的场景甚至更高。新架构 + 原生多模态加持下,日常对话、代码生成、简单 Agent 任务的体验都明显提升。

也有人比较谨慎:

  • 已经针对 V4 Pro 调优的提示词和业务逻辑,突然切换可能出现行为差异
  • 模型 ID 背后实际调用的模型随时可能变,可预期性下降
  • ToB 场景里,速度突然变快又可能在 V4.1 Pro 上线后再次变化,不好向业务方解释

这些担忧并非多余。稳定性和可复现性,对生产环境同样关键。

DeepSeek 用实际行动告诉大家:V4.1 Flash 已经足够强,没必要再让用户为落后的版本多付钱、多等时间。




上一篇:AI Infra 边界重写:推理成新中心,Agent 把生产问题提前了
下一篇:set_false_path 别乱用:FPGA 时序约束与 CDC 跨时钟域避坑指南
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-9-17 12:45 , Processed in 0.453989 second(s), 39 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表