找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

5915

积分

0

好友

738

主题
发表于 4 天前 | 查看: 4| 回复: 0

Qwen 官方刚刚宣布,Qwen3.8-Max 迎来 0902 版本升级。

新版本 Qwen3.8-Max-0902 正式上线。官方明确表示,这一次进一步针对 Coding & Cowork 进行训练。

Qwen3.8-Max-0902官方发布公告截图

就在此次升级后,Qwen3.8-Max-0902Code Arena: WebDev 整体排名中以 1691 分首次登顶第 1 名,直接来到榜首。

Code Arena WebDev榜单Qwen3.8-Max-0902排名第一

这个成绩也让 0902 此次升级的重点更加清晰:Coding 能力是这次强化的核心方向之一

Qwen3.8-Max 此前已经是 Qwen 的旗舰模型。

公开资料显示,Qwen3.8-2.4T-A95B 采用稀疏 MoE 架构,总参数达到 2.4 万亿,每个 Token 约激活 950 亿参数,上下文窗口最高可扩展至约 100 万 Token。

云端版本 Qwen3.8-Max 进一步加入了视觉输入、工具调用等生产环境能力,重点面向 Coding、专业工作、科研以及长周期 Agent 任务。

与推出一个全新模型不同,这次 0902 并没有把重点放在继续扩大参数规模上,而是通过进一步的 后训练,强化模型在真实工作环境中的表现。

官方给出的定位非常直接:2.4 万亿参数、100 万上下文,继续强化复杂任务

从此次放出的测试表来看,0902 版也重点覆盖了大量 Coding 和 Agent 相关任务。

Qwen3.8-Max-0902 Coding与Agent性能对比表

同时,0902 依然强调了 100 万 Token 上下文。对于 Coding 和 Cowork 来说,长上下文的重要性非常明显。

一个大型代码仓库可能就有几十万 Token,一份科研资料、实验记录或者企业内部文档,也可能非常庞大。

如果模型只能看到其中一小部分,就很容易出现:前面看过的内容忘了,后面的内容又接不上。

而百万 Token 级上下文,可以让模型一次性容纳更大规模的工作环境。

这也是 Qwen3.8-Max 一直强调长周期任务的基础能力之一。官方云端版本目前仍提供最高约 100 万 Token 上下文窗口。

在价格方面,0902 并没有带来明显的价格上涨,Qwen 官方公布的 Qwen3.8-Max-0902 API 价格仍然非常有竞争力:

输入 2 美元/百万 Token,输出 6 美元/百万 Token。

缓存命中方面,显式缓存命中价格为 0.17 美元/百万 Token,隐式缓存命中为 0.25 美元/百万 Token

目前,Qwen3.8-Max-0902 已经通过 QwenCloud API 正式上线。

回看 Qwen3.8-Max 的演进路线,这次 0902 并非突然转向。此前 Qwen3.8-Max 已经把目标从单轮问答进一步推向 Coding、办公、科研、Agent 和长周期任务。

甚至在模型训练层面,Qwen 也开始围绕真实环境、任务难度、工作空间和 Harness 建立更完整的训练体系。

而这次 0902 又进一步强化 Coding & Cowork,某种程度上也说明 Qwen 正在继续把模型能力从回答问题推向完成任务。

更多关于 Qwen、AI 模型与开发者前沿动态,欢迎到 云栈社区 交流。




上一篇:Shell 编程入门教程:Linux 变量、字符串与脚本执行详解
下一篇:Keil map 文件详解:内存映射、符号表与数据大小分析
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-9-10 17:00 , Processed in 1.288429 second(s), 42 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表