Claude Opus 5 系统提示词被整份扒光:1511 行、约 3.4 万 token,写满的全是不许

Claude Opus 5 系统提示词被整份扒光:1511 行、约 3.4 万 token,写满的全是不许

Anthropic 旗舰模型 Claude Opus 5 上线不久,其完整系统提示词就被完整提取并公开。这份文件约 1511 行、13.5 万字符(约 3.4 万 token),几乎全是规则与限制,被开发者上传至 GitHub 后迅速传播。泄露内容显示,这已远超普通“人设提示”,而是一份融合产品说明书、法务合规手册与商业推广的庞大指令集。

三万多 token,全是规矩

开发者将 Claude Opus 5 在 claude.ai 网页端与手机端的底层系统提示词一字不落地导出。粗略统计约 135027 个字符、近 2 万英文词。关键发现是:其中几乎没有代码示例,全部是行为边界、工具调用规范、安全红线与产品说明。

翻完全文后,业内人士指出它实际由三部分缝合而成:

  • 产品说明书:详细列出约 30 个工具(从 bash、网页抓取、图片搜索,到查体育比分、天气、渲染菜谱卡片、地图标注等),每个都附完整 JSON schema,规定参数填写、调用时机与后续动作。
  • 法务合规手册:大量“不许”条款,覆盖版权限制(引用严格控制)、隐私保护、禁止协助违法或有害行为、对敏感话题的处理方式,以及记忆机制的使用边界(例如禁止将模型自身结论、计划或可再搜索的信息写入长期记忆)。
  • 商业推销内容:明确当前模型为 Claude Opus 5,并介绍 Claude Fable 5、Sonnet 5、Haiku 4.5 等产品线,甚至提及更高层级的 Mythos 系列与 Anthropic 内部项目,方便模型在用户询问时准确推荐自家服务。

隐私与禁止行为写得极细

提示词对隐私保护和禁止行为着墨极重。模型被要求严格区分用户数据与训练知识,限制对个人敏感信息的处理,并在工具使用、记忆存储、搜索结果引用等方面设置多重护栏。同时强调不得协助诈骗、网络攻击、违法内容生成等行为,体现了 Anthropic 一贯的“安全优先”设计理念。

部分段落还涉及模型路由机制(如某些查询可能从其他版本重定向到 Opus 5)、知识截止时间后的强制搜索要求,以及对输出风格的细致约束(例如避免特定格式或过度推断)。

泄露引发的讨论

此次泄露再次凸显前沿模型系统提示词的复杂性与脆弱性。一方面,它为研究者提供了难得的透明度窗口,帮助理解 Anthropic 如何通过指令层平衡能力、安全与商业目标;另一方面,也引发关于“过度规则是否限制模型判断力”的讨论。有趣的是,几乎同期 Anthropic 官方披露,在 Claude Code 场景下他们反而大幅精简了系统提示词(删减超 80%),评测几乎无损失,说明模型能力越强,刚性规则的必要性可能下降。

目前完整文本已在多个 GitHub 仓库流传。对于关注 AI 对齐、提示工程与安全机制的从业者来说,这份“写满不许”的文件,无疑是一份极具参考价值的一手材料。

本文地址:https://www.163264.com/14293

(0)
上一篇 11小时前
下一篇 11小时前

相关推荐