智能体对算力的使用方式正在发生根本变化。本周,AWS宣布AgentCore支持最长14天的持久计算会话,多个AI智能体可以“同住”一台EC2实例,共享同一个运行时实例的会话与依赖——智能体从按次调用的“钟点工”,变成了长期驻留的“长租房客”。 这一模式的商业逻辑相当直白:行业平均资源利用率长期停留在30%至40%区间,而AgentCore给出了一个清晰的盈亏平衡点——只要CPU利用率达到24%,持久计算模式即可实现盈亏平衡。让智能体从8小时会话延长到14天常驻,正是把资源利用率从低谷拉起来的关键手段,也是对闲置算力的二次定价。 常驻之后,数据中心运营也跟着改变:负载从波峰波谷走向持续高位,能耗与余热输出变得稳定可预期,绿色算力与综合能源利用第一次和智能体的“入住率”挂上了钩。与此同时,头部企业开始把智能体编排写进日常生产流程,常驻算力从尝鲜变成刚需。
文章图片 2
住得久了,规矩也要跟上。AWS开源的Dogwood语言专门用于描述智能体工具调用策略,用时序操作符约束“什么时候能调用什么工具”;MCP标头机制则要求智能体申报所需的工具权限,调用前明牌、调用后可审计。工具调用从“模型自己看着办”变成“先立规矩再动手”,智能体的权限与安全边界被重新定义。 这套“长租+立规+计量”的走向,背后是算力供给与智能体工程化之间的深度耦合。星战科技聚焦GPU算力平台与算力调度能力,为企业提供训练与推理任务的统一调度与资源管理,帮助团队把智能体的长周期运行、任务编排与资源利用纳入统一体系,让常驻智能体获得稳定、可度量的算力底座。 更值得注意的是可观测性开始计价:Cloudflare发布的Agent Tracing给不同框架的智能体统一做可观测,超出额度按每百万事件0.6美元计费。当智能体的每一次“思考与行动”都被计量,Agent基础设施的标准化就真正落地了——这比Agent本身更先成为一门生意。
文章图片 4
从AWS的长租到Dogwood的门规、再到Cloudflare的水电表,基础设施正在第一次为“群居的智能体”设计计价单位。智能体算力从按次计费走向持续运营,将重塑云服务、算力调度与运维治理的整套规则。