据彭博社报道,由于内存芯片成本大幅上涨,英伟达一些最大客户已经被告知,搭载英伟达AI芯片的服务器价格在很多情况下将上涨超过15%。涨价将从明年年初出货的服务器开始生效,受影响的产品包括搭载旗舰级Vera Rubin和Grace Blackwell芯片的服务器,具体涨幅取决于芯片世代与内存配置。 这一轮涨价的核心推手是内存成本。AI服务器中高带宽内存的配置占比不断抬高,内存芯片价格波动对整机成本的影响越来越大,英伟达与服务器厂商不得不把成本压力向客户端传导。近期,为微软、谷歌、甲骨文等大型数据中心运营商代工生产服务器的企业,已经陆续通知客户即将到来的涨价。 对云厂商和算力采购方而言,这意味着一轮明确的成本上行。AI基础设施的投资本来就以规模取胜,如今单台服务器的购置成本还要再上一个台阶,头部云厂商的资本开支计划与利润率都将承压。算力从供不应求走向结构性涨价,正在成为行业共同面对的新变量。
文章图片 2
涨价带来的直接问题是成本传导的不确定性。英伟达即将在8月26日公布第二季度业绩,市场正把注意力放在其对后续出货与定价的指引上。对企业用户来说,算力采购窗口期的判断变得更重要,既要避免在高点集中采购,又要防止错过扩产的时机,成本治理能力被摆到了更靠前的位置。 在算力成本上行周期里,把钱花在刀刃上比以往更关键。星战科技聚焦GPU算力平台与算力调度能力,帮助企业把训练与推理任务统一管理、按需弹性分配,减少算力空转与资源浪费,让有限预算下的算力投入产生更高的业务价值,也在一定程度上对冲硬件涨价的冲击。
文章图片 4
从更长远的视角看,这次涨价也将加速算力供给结构的调整。内存供给紧张会推动芯片与内存厂商扩产,也会让能效更高、单位Token成本更低的新一代算力平台获得更多关注。算力用户在选择硬件时,会更看重单位成本下的有效产出,而不只是纸面峰值性能。 涨价短期难以逆转,但企业并非只能被动接受。把算力当作需要精细运营的资产,用调度与规划来优化每一分投入,将成为AI落地企业在成本上行期的必修课。算力成本的每一次波动,都在提醒行业:降本增效的关键不仅在芯片,更在平台化的算力管理能力。