Anthropic旗舰模型Claude Opus 5上线仅24小时,其完整系统提示词便被开发者Eversmile1一字不落地扒下,整份传至GitHub。本地统计显示,这份文件包含135027个字符、19370个英文词,约3.4万token,没有一行代码,全是规矩。翻完64章内容会发现,这已经不是一份简单的提示词,而是产品说明书、法务合规手册和自家产品推销渠道的三合一缝合体。
这一事件的背景在于,大模型的能力边界正在由提示词工程决定。30个工具从bash命令行、网页抓取、图片搜索,一路排到查体育比分、拉天气、渲染菜谱卡片,每个工具都带着完整的JSON schema。但篇幅最长的不是任何一个工具,而是记忆管理章节,足足230行把Claude的跨会话记忆写死了。每一行记忆前面必须打一个[stated]标签,意思是用户亲口说过,围绕这一个标签,禁令列了一长串。
从行业趋势看,这份泄露文件揭示了大模型竞争的下一个维度:治理复杂度。当模型能力趋同时,决定产品体验的不再只是参数规模,而是如何在不损害用户体验的前提下,把安全、合规、商业诉求写进模型的每一次决策。Opus 5的提示词里,版权部分是一条主规则加四道补丁,每道补丁堵住一个绕开主规则的办法。主规则只有一句:引用原话,一次不得超过15个词。

但问题也随之而来。一份配置文件需要3.4万token才能写完,这本身就说明大模型治理已经进入了一个新的阶段。过去行业关注的是模型能不能做更多事,现在更关键的是模型在什么情况下必须闭嘴。隐私黑名单从种族、政治立场一路排到健康诊断、MBTI人格测评,以及关于孩子的一切。撞上黑名单后的处理逻辑更是见功力:用户说糖尿病犯了,只能记对健身有兴趣,健康部分整个删掉。
星战科技在大模型API广场方向的产品设计,正是基于对这一行业趋势的判断。通过统一接口聚合国内外主流开源与闭源模型,企业可以根据具体业务场景的性能要求、成本预算和安全需求,灵活选择最合适的模型。当Opus 5以Fable 5一半的价格提供接近的性能时,企业需要的不是盲目追新,而是一套能根据任务复杂度自动路由到最优性价比模型的调度机制。

上线24小时,Opus 5的能力被全网测了个遍,规矩也被全网抄了一遍。一份系统提示词被扒光,本该是场事故,翻到最后会发现,最值钱的不是任何一条工具参数,而是那一长串不许——不许多引一句,不许多记一行,不许替用户做一个决定。24小时里,Opus 5能力的上限已经被开发者测了个遍,而它的下限,早在这3万token里被人一条条摁死了。