此次内测的核心技术突破在于动态算力分配机制——通过将大模型推理任务智能拆解至本地芯片与云端GPU集群,既保障了隐私数据的终端处理效率,又利用云端基础设施实现长周期任务的零中断执行。测试用户需升级至天禧智能体3.6版本,通过分布式队列系统获取限量邀请码,即可体验混合架构下的百亿参数模型调用服务。
文章图片 2
当前AI产业正经历第三次算力范式迁移,从早期的纯云端部署到端侧轻量化,再至如今的协同计算阶段。联想的方案显著降低了用户使用大模型的能源与硬件成本,其云端任务持久化技术可能成为未来AI PC的标配功能。 值得关注的是,该架构对芯片层提出了新要求:终端需搭载具备低功耗协处理能力的NPU,而云端则依赖异构计算资源池。这种基础设施的升级需求,或将刺激边缘计算芯片与分布式训练框架的市场增长。