7月17日,2026世界人工智能大会在上海拉开帷幕。新一代AI基础设施服务商阡视科技,携最新专为Token工厂而生的超节点真机亮相,呈现下一代国产超节点技术的底层智算逻辑与系统级性能拓展路径。
当前,人工智能技术正从推理时计算演进至递归自我改进阶段,长程连续迭代与闭环规划任务成为下一阶段的核心范式。在此范式下,KV Cache的频繁读写使存力成为新的系统瓶颈。传统超节点架构主要侧重于GPU的互联平面,重点解决芯片间横向通信的瓶颈。对于Token工厂场景来说,无法满足超长上下文的运算效率问题。
阡视科技自主研发的wylon超节点系统,具备横向算力互联能力的同时也实现了全域无阻塞的卡间全互联通信。它定义了一个新的纵向存力贯通平面,系统打通了异构存力资源的层级架构,构建起百TB级GPU近存、系统内存以及PB级大带宽闪存空间。结合HitenOS大模型操作系统的高效软硬件深度协同设计,在国产GPU平台上实现了同一速度下更高吞吐、同一吞吐下更快响应的帕累托改进,可达10倍以上性能的提升。

通过对Token工厂场景的深入分析以及软硬件联合设计研发,wylon超节点系统实现了KV分层管理、算力亲和调度、硬件拓扑感知等底层能力,确保模型负载直达硬件底层,避免中间层性能损耗。这为大模型运行提供了一体化的高效算力空间,满足Agent时代对大算力、大带宽、大存储的需求,并持续降低Token成本。
阡视科技此次亮相的wylon Q72/288,单机柜集成72颗国产GPU,4机柜横向互联域扩展至288卡规模,GPU高带宽显存可达18TB,互联总带宽可达72TB/s,支持FP8/4浮点运算精度。专为KV Cache设计的统一DRAM缓存可达上百TB,为大模型推理提供一体化的高效算存空间。基于wylon超节点架构的新云Token工厂,现已在华东集群节点上线并邀请测试。
从星战科技GPU算力平台的视角看,阡视科技的超节点架构揭示了一个重要趋势:当AI推理从短对话走向长程Agent任务,算力瓶颈正在从计算密度转向存力带宽。星战科技在算力调度领域的实践同样关注这一方向——弹性调度不仅要解决GPU资源的分配效率,还要解决长上下文场景下的存力访问延迟。wylon系统的纵向存力贯通平面与星战算力平台的调度策略形成互补:前者解决硬件层的存力瓶颈,后者解决资源层的分配效率。
wylon超节点系统深度联合寒武纪、壁仞、沐曦、曦望、海光、摩尔线程等国内GPU芯片企业,构建起从芯片到系统、从算力到生态全栈贯通的国产AI基础设施。这种生态协同模式与星战科技MCP市场的工具接入逻辑异曲同工——都是通过标准化接口和生态协作,降低企业接入和使用AI能力的门槛。
当Token工厂成为算力供给的基本形态,超节点架构的竞争将不再只是单卡性能的比拼,而是系统级的存算协同能力。国产算力正在从追赶单卡性能转向构建系统级优势,这条路径的成败将决定中国AI基础设施在全球竞争中的位置。