智谱近日把Token搬上了天猫。在“智谱旗舰店”里,GLM Coding Plan被做成几件标准商品:个人版Lite、Pro、Max,以及团队版标准席位,月付价格分别为118元、538元、1078元和598元。套餐基于GLM-5.3,支持ZCode、Claude Code、Codex等20余款主流Agent,智谱还表示未来用户购买Token可直接在电商平台完成。
一个疑问随之而来:智谱已经拥有自己的MaaS平台,截至8月底企业及开发者用户超过740万,为什么还需要天猫?答案或许在于“消费方式”的改变——对重度开发者来说天猫可有可无,但对轻度AI用户和中小开发者,天猫把复杂的技术术语打包成了看得懂、买得了的商品,像充话费一样按需购买。
更值得关注的是Agent带来的Token消费结构变化。一个Coding Agent会连续阅读代码、修改文件、运行测试、分析报错,模型不再只回答一次问题,而是在完整任务中持续被调用,形成高频的持续性消费。这也是智谱过去一年押注AI Coding的底层逻辑——把一次性问答变成持续消费。

财务数字印证了转向:2026年上半年智谱收入9.54亿元,同比增长399.7%,其中开放平台及API业务收入8.25亿元、同比增长2735.7%,占总收入86.5%,取代本地化部署成为最大收入来源;去年同期这一占比只有15.2%。截至8月底,MaaS平台Token调用量较年初增长超40倍,付费日活用户增长603%。
且慢欢呼。智谱API量价齐升背后仍有隐忧:截至8月底API平均售价较年初提升约101%,增收明显,但上半年整体毛利率从去年同期的50%降至26.4%,经调整净亏损19.64亿元。Token调用量增长40倍,用量扩张反而抵消了单位成本下降——用户问得越多、Agent跑得越复杂,推理基础设施的算力支出越大。
智谱自己给出的解法是降低单次调用成本:通过国产算力、模型优化与基础设施建设,把单位Token推理成本较年初下降80%,并披露已实现10万卡级国产芯片规模化低成本推理。当Token像水电煤一样成为被高频消费的商品,竞争就从“谁的模型强”转向“谁能用更低的成本生产同样质量的Token”。

把Token搬上电商货架,其实是在给“大模型服务”重新定义购买入口:用户不必理解API与Token的技术细节,只需要像订阅会员一样为能力付费。这种消费化的背后,是模型调用从项目制走向持续订阅制的商业模式迁移,也让“透明计量、按需付费”的算力服务变得更重要——星战科技大模型API广场围绕Token计量与弹性调用建设的正是这一层基础设施。