腾讯今日发布混元 Hy4 preview:总参数 770B、激活参数 49B,上下文长度突破 1M,重点面向 Agent、Coding 与生产力场景优化。相比上一代,它在多步骤 Agent、代码开发和生产力任务上进一步提升,强调更好的任务拆解、上下文承接、指令遵循与长链路执行能力。模型已同步开源,并在 WorkBuddy、CodeBuddy、元宝、ima 等产品首发上线。 更值得关注的是,Hy4 preview 首次参与自身研发全链路——训练方法、数据策略、评估体系甚至底层算子的自动优化。模型提出方案、运行实验、根据结果迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。它还通过自主分析推理系统瓶颈,围绕算子融合与通信优化多轮改进,端到端吞吐相较基线提升 31.8%。
文章图片 2
定价方面,Hy4 preview 继续走普惠路线,输入 6 元/百万 tokens、输出 18 元/百万 tokens,缓存命中低至 0.3 元/百万 tokens,并为 WorkBuddy 和 CodeBuddy 用户提供两周限时免费。从开源到低价,再到深度绑定智能体产品,腾讯的打法很清楚:让模型尽可能多地进入真实业务场景,用使用量换能力进化。 实测中,Hy4 preview 在 WorkBuddy 里的表现已经具备“把一件事情做完”的能力——自主拆解任务、调用工具、完成交付,但关键节点仍需要人盯,存在“最后一公里”问题。这既是当下 Agent 产品的普遍状态,也说明智能体协作距离完全自主还有一段路要走,人的审核与兜底在现阶段仍然必要。
文章图片 4
一个趋势愈发清晰:大模型竞争的重心,正在从“参数多寡”转向“工程化能力”。能否让模型自我优化、能否让模型在真实业务中稳定完成任务、能否把模型能力通过 API 和智能体工作台顺畅交付给开发者,正在成为拉开差距的关键。这与星战科技在大模型 API 广场与智能体协作方向的布局逻辑一致——模型只有进入可编排、可调用的平台生态,才能真正转化为企业生产力。 对开发者而言,Hy4 preview 的开源与低价接入,意味着又多了一个高性价比的模型选择;对企业而言,1M 上下文与 Agent 优化方向,让长文档处理、复杂工作流自动化等场景有了更实际的落地可能。开源生态的竞争,最终会落到谁能被更多业务“用起来”。
文章图片 6
混元 Hy4 preview 的开源发布,把“模型自我进化”从概念推进到了可运行的产品状态。当模型开始参与训练和优化自己的下一代,大模型时代的竞争逻辑,也许真的变了。