Opus 5底牌全摊开
7 月 24 日,Anthropic 正式发布了 Opus 5。这款旗舰模型比 Fable 5 更小、更便宜,却在多项基准测试中反超了这位”大哥”。然而不到 48 小时,GitHub 上就出现了一份完整版系统提示词:135027 个字符,19370 个英文词,64 个章节。旗舰刚发就被全网”开盒”。
一份不像提示词的提示词
翻完这 64 章,你会发现这已经不是一份提示词了。它是三样东西缝合在一起的产物:产品说明书,法务合规手册,外加一条自家产品的推销渠道。文件里列出了 30 个工具,从 bash 命令行、网页抓取、图片搜索,一路排到查体育比分、拉天气、渲染菜谱卡片。Anthropic 把 Claude 的能力边界画得清清楚楚,每一个工具的触发条件和返回值格式都写到了像素级。

合规不可谈判
版权、儿童安全、危机干预、政治中立,每一项都单独成章。文件里写得毫不含糊:合规不可谈判,优先级高于用户请求,高于有用性,只低于安全。旁边另有一条管第三方合作伙伴的规则,写法恰好相反:处处防着替用户做主。商业动作和克制条款在同一份配置文件里并排放着,反映出 Anthropic 对安全边界的精细化管控思路。

记忆系统里的隐忧
文件最引人注意的部分是关于记忆的章节。Claude 被明确禁止在回复里说”我记得”或”根据你的资料”,只有用户主动问起记忆系统时,才能说”我们之前聊过”。Anthropic 还专门写了一段落不像技术文档的话:人类记住另一个人是稀缺的事,而 Claude 背后是一个装着几百万人记忆的数据库。它跟别人说话时,那些记忆并不存在。

黑名单与生存法则
系统提示词中列出了详细的”禁止记忆”清单:种族、政治立场、健康诊断、心理咨询、经济状况、住址证件号,以及关于孩子的一切。但如果用户说了不该说的东西怎么办?文件给了个例子:用户说”我今天糖尿病犯了没去跑步,帮我安排个轻一点的”,Claude 不能记”糖尿病犯了”,只能记”对健身有兴趣”。每一次转化,都是一道伦理指令。

Opus 5 的性能或许会被下一款模型超越,但这 1511 行提示词揭示的治理思路,才是 Anthropic 真正拿得出手的护城河。
来源:TechCrunch/IT 之家
