【SMM分析】GPU换代,不等于被淘汰

来源:SMM

一台用了2年的H20八卡服务器,二手报价192万元,同配置全新机240万元——两年只打了八折,折合年化折旧10%。同期,海外H100单卡24个月保值率75%—85%,中国2024年采购的H100整机回收价仍合出厂价8—8.5折。而对照品的表现完全不同:同代际的CPU服务器三年残值仅约15%。SMM采集的这组报价指向一个反常识的结论:这类设备的估值基准不在二手市场,而在它尚未停止的出租能力上

现象:用两年的机器,为什么还能卖八折

一台用过的服务器该值多少钱?市场给出的答案是八成。

SMM采集到的一笔报价显示,某二手设备回收平台9月8日现货报出某品牌H20八卡服务器12台,已使用2年,单台报价192万元;同配置全新机报价240万元——两年折价48万元,残值率80%,折合年化折旧10%。配置包括1TB DDR5 4800MHz内存、2块960GB系统盘、2块3.84TB数据盘、8块HGX SXM5 H20 96GB计算卡、400G网卡与6个3000W电源模块,质保条件为测试通过后不保修。

拆到单卡来看更直观:192万元除以8,相当于每卡24万元,而这台机器还要连带1TB内存、4块硬盘、400G网卡与6个3000W电源。若只买8个一套的H20计算模组,价格为120万—125万元,折合每卡15万—15.6万元。整机比裸模组多出来的部分,价格接近模组本身的一半——二手机器的报价,一半买卡,一半买围绕卡的那套系统。

这个折价幅度放在不同参照系里,含义并不相同。与海外同代际产品比,它落在区间之内而非之外:第三方二手市场聚合数据显示,H100 SXM5在24个月的保值率为75%—85%。与中国市场自身的历史比,它还偏低:行业口径显示,2024年采购的H100整机(当时售价250万—280万元),2026年回收价仍有170万—180万元,约合出厂价8—8.5折。

构成真正反差的是与通用服务器的对照:同代际的CPU服务器三年残值仅约15%。同样的折旧年限、同样的机架、同样的机房环境,一边三年剩一成半,一边两年还剩八成。

这个价格也不是在卖不出去的情况下报出的。国内二手渠道约20台高端算力八卡准现货,两三天即可售罄。

价格坚挺在三个市场同时出现——新机、二手、租金。租赁端信号同样向上:H100一年期合约价从2025年10月约1.70美元/GPU-h升至2026年3月约2.35美元/GPU-h。如果设备真的在快速贬值,租赁价格应该下行而不是上行。三个市场同向,说明这不是某一种报价方式的口径问题。


机制:被换代,不等于被淘汰

先说一个被普遍误读的地方:这类设备被替换,原因通常不是坏了。

工程侧的统计可以说明。某GPU服务器服务商对2024—2026年8000余台设备的故障工单统计显示,故障占比最高的是电源子系统,达35%;其次是散热与温控27%、PCIe与互连18%;显存与GPU核心合计仅12%。也就是说,八成"设备故障"发生在电源、散热、互连这些外围部件上,而非芯片本身——其中多数可修复、可更换,更换电源模块的成本与更换一颗加速卡不在一个量级。

需要说明的是,热是这些外围部件失效的主要加速因子:热循环应力导致焊点疲劳,高结温加速电迁移与介质击穿,导热硅脂干结又反过来推高结温。但它的作用方式是加速可靠性衰减,而不是直接让芯片报废——这是"散热不好"与"芯片坏了"之间的区别。

器件级的设计数据更直接:GPU的设计平均无故障时间约5.7年,HBM约22.8年(系统设计口径,为留冗余的保守值,对应单卡年化失效率约17.5%,高于现场实测)。而真正让机房"看起来总在修"的,是系统级联:一个计算节点是串联系统,8颗GPU加2块网卡加2个电源共12个独立部件,任一失效即节点失效,单节点平均无故障时间因此降至约5172小时;1250个节点组成的集群,平均无故障时间只剩4.14小时——每几小时一次故障是稳态,不是异常。芯片很可靠与机房天天在修,两件事并不矛盾。

那为什么还要换?因为淘汰由经济性驱动,而不是由物理寿命驱动。2026年的换代节奏已由架构更新主导——架构周期从两年一代压缩到一年一代,新一代产品2026年6月量产、下一代排至2027年一季度。换代变快不是因为晶体管变快,而是因为设计变快。同时,新卡的每瓦性能持续提升,但单卡绝对功耗是上升的:A100约400W、H100约700W、最新一代已突破1400W。要吃到新的能效,就必须同步改造配电与散热,换卡的账单远大于卡本身。

软件层把这条曲线的尾部拉得更长。CUDA向下兼容,使同一批硬件的经济寿命显著长于产品周期:2020年发布的A100,厂商公开表述其"有效至2029年";已有云服务商签署把A100租至2029年的合同——一张两代以前的卡,合同走完接近十岁。

芯片不是用坏的,是被比下去的。


逻辑:价格要成立,还需要一条卖得出去的通道

被换代却没有被淘汰,只是"值钱"的必要条件。价格要真正立住,还需要一条能把它卖出去的通道。

二手设备有四类出口:经纪商大宗处置、运营商之间的直接转让、原厂以旧换新、停业清算拍卖,其中经纪商是主渠道。决定清算速度的是一条常被忽略的规律——整体流动性:八卡整机比八张散卡好卖,因为买方要的是可直接部署的单元,而散卡受制于高质量的HGX基板与NVSwitch组件供给。

本次采集的报价提供了一个更具体的证据:那台H20的八卡GPU模组可以脱离整机单独报价,8个一套为120万—125万元,占全新整机价值的50%—52%。模组能单独成交,本身就是流动性的直接体现。

把两个价格放在一起验算,会得到一个干净的吻合:模组120万元打八折,加非模组部分120万元打八折,恰为192万元;按125万元口径计算,125万元打八折加115万元打八折,同样得到192万元。也就是说,192万元这个报价,等价于"全部件统一打八折"——二手市场对GPU与对内存、存储、网络、电源用的是同一套折旧口径,并不存在"卡保值、配套件归零"的差别定价。这也从侧面回应了整机与单卡口径是否打架的问题:在本样本里,两者并不打架。

由此可以推出一条买方决策的临界线:若不买整机、改为采购8个模组再自配其余部件,192万元减去120万至125万元,留给配套件的预算为67万—72万元。配套件市场采购价低于这条线,自配更划算;高于这条线,买整机更划算。而这条线会被内存价格顶上去——DDR5是本轮涨幅最大的部件,1TB服务器内存的价格上行,会直接托住二手整机的残值。内存涨价因此不只是新机的成本问题,也是存量设备的残值支撑。

再往上一层是金融通道。2026年8月,英伟达与六家机构签署谅解备忘录,设立独立的算力融资平台,目标撬动超5000亿美元第三方资本,英伟达持有对合格项目最高25%(约1250亿美元)的残值兜底选择权。需要说明的是,这是选择权而非既定担保:一项目一评估、仅覆盖部分项目,英伟达不承担项目整体兑付责任,5000亿美元是目标规模而非已承诺资本。它的实质效果,是把"残值可验证"变成可抵押的资产。

中国市场还叠了另一层。受出口管制影响,合规渠道可买的数据中心级卡实际收窄至H20与B30,更高阶型号整柜禁售。结果是价格错位:H20 96GB单台现货报价191万元,而海外最新一代整机出厂价约合人民币210万—350万元——一台被降规格的特供卡,价格已逼近海外最新一代整机。这部分溢价与设备性能无关,与管制口径直接绑定。

对照国产路线,差异恰好集中在这一处:二级市场几乎不存在,退役设备的残值接近零。权威媒体的分析把它归为四个前提——二级市场流动性、代际兼容性、成熟的运维生态、可验证的残值曲线,国产路线四点均有缺失。本系列上一期讨论过,退役设备能否被定价与流转,是国产算力成本线高于另一条路线的成因之一;本期把这个问题反过来问,得到的是同一个答案的正反面。

理论边界:四个会让结论失效的地方

本文的结论有四处限制场景:

第一,三组残值口径互相打架,不能直接比较。中国整机回收价8—8.5折、海外单卡24个月75%—85%、海外翻新八卡整机约为2023年原价的35%—40%,三个数字差距近一倍。差异来自基准价:前两者相对出厂价或挂牌价,第三者相对2023年原价——而最新一代产品的现货价在半年内翻倍,把"原价"这个基准本身也抬高了;同时单卡与整机的口径也不同,整机还含机头、互连、网络与存储。本文并列列出,不作直接比较。

第二,本次样本的分母性质需要标注。240万元是"同配置全新机报价",不是两年前的原始采购价。若该型号因供应收窄、新机价本身已含政策性溢价,那么80%这个比值相对原购入价是偏低的,甚至可能接近零折旧。换言之,80%既是折旧口径的结果,也包含一块政策定价;两个因素各占多少,无法从单一报价中拆开,需要后续采集补充。

第三,这个价格有一个明确的窗口期。18—24个月的75%—85%是峰值区;到36个月,区间宽达30%—70%。且代际之间的贬值速度在加快——H100的贬值已快于A100的同期表现。

第四,会计寿命与商业寿命的差额尚未被确认。有投资人指控大型云厂商把服务器折旧年限拉长至5—6年,估算2026—2028年全行业低估折旧约1760亿美元;同期有海外云厂商主动把部分服务器折旧年限从6年缩短至5年,减少运营利润约7亿美元。器件级数据显示GPU设计寿命5.7年,而换代间隔已缩至12个月——这段差额在二手价格坚挺时不会显现,一旦二手市场转弱,会被集中确认。此外,兜底机制本身是带条件的:赔付义务恰好在算力需求回落时被触发,而接受融资的系统须遵循指定的架构标准,兜底的有效性取决于"另一个运营方能够接手并运行"这一前提是否成立。


SMM观点

残值率是成本法定价的第二条线。同一台设备、同一利用率下,残值假设从15%摆动到40%,等效折旧成本可摆动约40%。算力租赁的成本线有两条:一条由租金市场划定,一条由二手市场划定。只盯租金、不盯二手成交的定价模型,缺了一半输入;而缺的这一半,恰恰在设备最需要处置的时候起作用。

三层支撑里,只有一层是厂商能单方面提供的。软件后期更新维护由厂商控制,物理约束由客户的场地与配电条件决定,退出通道由市场结构决定——后两层都可能在12—18个月内变化。因此"二手贵"是一个有窗口期的状态,不是资产属性。

判断残值转折,看流动性指标而不是看新品发布。先行信号是挂牌与成交价差扩大、整机与散卡价差拉大、清算周期变长。二手市场的价差,比二手市场的价格更早说话。

保值率是一种融资工具,不只是一个估值指标。以最高25%的残值兜底选择权撬动数千亿美元资本,本质是把残值可验证转换为抵押品。反过来看,国产业务偏高的融资成本里,有一部分就是"残值不可验证"的定价——这不是资金面的差别,是资产可处置性的差别。

中国的二手价格里含禁运政策溢价,必须与技术性支撑分开计算。合规可买型号收窄直接推高价格,这部分与设备性能无关,随管制口径变动而变动。政策口径一变,这块溢价立刻重估。

上述判断落到操作层面,有一条具体建议。把存量价纳入算力价格指数的采集体系——现有采集只有流量价(月租、卡时),缺存量价:二手成交中位、挂牌与成交价差、整机与散卡溢价,以及保修状态这一项报价性质。没有存量价,指数回答不了"这门生意在什么价位还能退出去"这个问题。本次采集的报价,可以作为第一条存量价样本。

展望

短期(3—6个月):观察二手市场的流动性指标,而非新品发布节奏。挂牌与成交价差、清算周期、整机与散卡价差,这三项同时走弱,才是价格转向的先行信号。在此之前,二手机器的报价仍会跟着新机走,而不是跟着折旧走。

中期(6—12个月):看最新一代产品的实际放量节奏。这是36个月残值落在30%还是70%的唯一决定变量。同时需要观察合规渠道的可买型号清单是否变化——它决定中国市场上的那块政策溢价是扩张还是收缩。两个变量方向一致时,价格会加速;方向相反时,会形成一段横盘。

长期(1年以上):看"残值可验证"能否被制度化。若融资平台真正跑起来,算力资产的成本核算将从全成本口径转向净折旧口径,行业的估值方式随之改变;若不能,当下的坚挺仍会回到账面计提的节奏上。对买方而言,这意味着一个更实际的问题:设备的使用年限,究竟由技术决定,还是由资产退出通道决定。在残值可验证之前,任何按时间计价的长协,都还缺一条腿。

暂无简介

曹正
微信二维码今日有色
微信二维码

微信扫一扫关注

下载app掌上有色
掌上有色

掌上有色下载

返回顶部返回顶部
publicize