过去一年显卡价格全面飙升,存储芯片短缺成为核心推手。德国市场的表现最具代表性,RTX 5090已经涨到6800欧元,折合人民币约46800至53040元。
一张显卡的钱,已经够买一辆入门级微型电动车了。
高端显卡因为涨价买不起,这事似乎可以被“AI市场需求旺盛”解释过去,但玩家终究还是要为自己的游戏体验买单。如今一张RTX 5090的价格比很多车还贵,价格能不能回到合理区间,才是大家最关心的问题。

这轮硬件涨价的根源非常清楚,说到底就是AI两个字,这里不再赘述。回到玩家视角,显卡是决定PC游戏画质与性能的核心硬件。随着新游戏对显存容量、光追性能和高分辨率渲染的要求持续走高,即便不追旗舰型号,很多人也可能需要升级显卡才能获得理想的游戏体验。

但如果市场价格迟迟不降,玩家就只能在降低画质、延长硬件使用周期和咬咬牙掏钱之间做选择。
而且,眼下AI到底是不是“伪需求”也得打个问号。不少人坚信AI泡沫迟早破裂,届时硬件价格会飞速回落。这种不想当“冤大头”的心态,让越来越多的玩家选择了观望。
当然,显存供应紧张还能持续多久,目前仍存在不确定性。即便抛开外部因素不谈,厂商产能、渠道库存和市场需求本身就是一个复杂的混沌系统,任何一个环节的变化都可能影响显卡最终的零售价。
价格高企叠加供需紊乱,走私套利空间自然就出现了。
澳门海关近期持续打击“水客”走私,查获多起涉及RTX 5090显卡和内存条的走私案件。

据澳门海关通报,9月11日至17日,海关在澳门国际机场、港珠澳大桥澳门口岸及关闸口岸截获12宗不法贩运个案,货物总市值约151万澳门元,其中包括359件AirPods耳机及2块RTX 5090显卡。

走私分子的藏匿手法五花八门。海关人员通过机检图像发现异常,在关闸口岸出境旅客检查区,有人将旧电子产品及怀疑银粒藏匿于衣物和身体各处,其中就包括大量内存条。更极端的案例里,有人把CPU和内存条用胶带直接粘在小腿上企图闯关。

RTX 5090之所以成为走私目标,核心原因就是价格暴涨。受供货紧张及AI抢购影响,美国电商平台上RTX 5090的价格已经飙升至7000美元(约合人民币46970元)以上,部分高端非公版型号甚至被炒到8000美元甚至更高。要知道,这款显卡的官方建议零售价仅为1999美元,如今市场价已经是原价的3.5倍以上。
显卡涨价的压力还在持续。据博板堂消息,AMD已通知渠道合作伙伴,自10月1日起对全球市场的显卡产品正式执行涨价,涉及RX 9000系列及上代RX 7650 GRE等型号。其中RX 9070上涨700元至6299元,RX 9060 XT 16G上涨600元至4899元,涨价主因是显存成本上涨约10%以及芯片代工成本增加。
内存市场同样疯狂。TechInsights半导体事业部高级副总裁崔正东(Jeongdong Choe)表示,内存涨价热潮还将持续3到4年。
更令人担忧的是AI存储需求的增速。崔正东指出:“AI存储需求的增速不再是历史上的1.2倍或1.4倍,短期内直接飙升至4至6倍。每家厂商仅新建一两座晶圆厂,根本不足以满足这一需求。”

需求暴涨凸显算力瓶颈,而具体到AI智能体执行效率,处理器表现成为关键。AI代码执行平台Daytona近日公布了最新的智能体AI基准测试结果,数据显示英伟达Vera处理器在沙盒启动速度和任务吞吐量上均优于AMD EPYC“Zen 5”架构产品。

在这项针对多智能体协同工作的集群测试中,英伟达Vera仅用10.8秒便上线了1000个沙盒,启动速度达到AMD基准测试芯片的8倍左右。具体数据上,Vera处理器达到了每秒13.3个智能体任务的峰值吞吐量,并且在扩展至2000个沙盒时耗时仅为27.4秒。

作为对比,AMD的基准测试芯片EPYC 9755上线1000个沙盒需要88.4秒,任务吞吐量在每秒11个左右趋于平稳。为了验证高频芯片的表现,测试团队还引入了主频更高的AMD EPYC 9575F处理器。虽然该芯片把1000个沙盒的上线时间缩短到了32.3秒,但其任务吞吐量却在每秒8个左右见顶。
换句话说,为了维持每秒1000个任务的并发量,英伟达Vera平台所需的服务器数量比EPYC 9755少15%,比EPYC 9575F少38%。
Daytona联合创始人兼首席技术官Vedran Jukić表示,真正重要的不是峰值性能,而是机器满载后的稳定性。他指出,Vera处理器在负载达到2000个沙盒时依然能保持稳定运行,而不是出现性能崩溃,这对于大规模AI基础设施的部署具有重要意义。

稳定的处理器性能为大规模部署铺平了道路,也对存储带宽提出了更高要求。据报道,市场研究机构Counterpoint Research最新评估认为,英伟达Vera Rubin AI平台的大部分产品将采用12层HBM4,而非此前传闻的8层方案。这一判断修正了其8月报告中Rubin将采用8层HBM4变体的预测。

此前有行业传闻称,英伟达要求内存供应商将HBM4堆叠层数从12层削减至8层,市场一度担忧HBM需求下滑会导致产能回流传统DRAM,进而压低内存价格。Counterpoint Research这次的观点直接缓解了SK海力士与三星电子面临的需求担忧。
韩系双雄正同步推进16层HBM4技术。SK海力士在今年1月CES上首次展示16层48GB HBM4,容量较36GB的12层版本多出三分之一,并已在二季度开始向主要客户批量供应HBM4。三星自2月起出货商用HBM4,12层产品最高提供36GB容量,其16层堆叠技术已具备量产条件,将视客户需求调整节奏。
需要指出的是,层数竞争之外,先进封装仍是关键制约。HBM必须通过先进封装与GPU集成,即便内存产量充足,封装产能仍可能限制AI加速器的整体供应。
与此同时,晶圆端的产能挤压同样不容忽视。高性能芯片消耗的晶圆产能可达传统DRAM的三倍以上,只要AI算力需求持续旺盛,消费端内存供应仍将偏紧。

从显卡到内存,再到AI加速器,整条硬件供应链都被裹挟在AI需求与存储短缺的双重压力之中。价格能不能降下来,取决于AI泡沫是否破裂、存储产能能否及时释放,还有渠道端的博弈结果。至少从目前来看,等等党恐怕还得再等等。对这类硬件涨价话题感兴趣的读者,也可以去开发者广场看看大家的讨论。