资讯详情

Claude Opus 4 系统提示词全解析:身份定位、知识边界与安全策略——基于 leaked-system-prompts 仓库的逐条拆解

📅 2026/10/3 8:28:02 | 华诺云谱 👁 阅读
Claude Opus 4 系统提示词全解析:身份定位、知识边界与安全策略——基于 leaked-system-prompts 仓库的逐条拆解
人工智能大模型提示工程【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址https://gitcode.com/GitHub_Trending/le/leaked-system-prompts点击查看免费下载本文以 anthropic-claude-opus-4_20250522.md 这份于 2025 年 5 月 22 日从 Anthropic 官方发布说明中泄露的 Claude Opus 4 系统提示词为骨架逐段拆解其身份声明、产品边界、提示工程指导、安全伦理约束、对话风格规范与知识截止机制。读者读完可以系统掌握 Claude 4 家族系统提示词的完整设计脉络并借助同仓库多个版本对照理解 Anthropic 在一段时间内对助手行为约束的迭代方向。一、文档来源与本仓库的定位README.md 说明本仓库是一份广泛使用的 LLM 服务泄露系统提示词的合集收录了 OpenAI、Google、Anthropic、xAI、DeepSeek 等多家厂商在不同时间点的系统提示词快照且要求提交 PR 时必须附带可验证来源。本关联文档 anthropic-claude-opus-4_20250522.md 的文件头source字段标注其原始出处为 Anthropic 官方发布说明中的 May 22nd 2025 条目属于官方口径下公开可查的系统提示词版本。仓库中与本文档直接相关的姊妹版本包括anthropic-claude-4_20250522.md 与 anthropic-claude-sonnet-4_20250522.md同日发布的 Claude 4 家族总版本与 Sonnet 4 版本anthropic-claude-opus-4_20250731.md、anthropic-claude-opus-4_20250805.mdOpus 4 的后续修订版本用于对照提示词随时间的演化anthropic-claude-opus-3_20240712.md上一代 Opus 3 的系统提示词用于跨代对比。由于本文档是 Anthropic 官方发布的系统提示词原文以下内容以条款式转述 源码/仓库证据交叉印证的方式展开尽量保留原文的精确表述结构。二、身份定位Claude Opus 4 与 Claude 4 模型家族系统提示词的第一段即声明The assistant is Claude, created by Anthropic.助手是 Anthropic 创建的 Claude并注入动态占位符{{currentDateTime}}作为当前日期。随后文档明确了模型身份This iteration of Claude is Claude Opus 4 from the Claude 4 model family. The Claude 4 family currently consists of Claude Opus 4 and Claude Sonnet 4. Claude Opus 4 is the most powerful model for complex challenges.家族构成Claude 4 家族当时仅由两个成员组成——Opus 4 与 Sonnet 4。这与 anthropic-claude-sonnet-4_20250522.md 中Claude Sonnet 4 is a smart, efficient model for everyday use面向日常使用的高效模型的定位互为对照Opus 4 主打复杂挑战的顶级能力Sonnet 4 主打日常场景的效率与性价比二者构成能力最强 均衡高效的双旗舰布局。模型字符串文档明确给出了调用 Claude Opus 4 的 API 模型标识claude-opus-4-20250514日期后缀表示该快照的发布日期 2025-05-14。这一点对开发者尤为重要——同一模型家族的不同能力档位通过不同的模型字符串区分且字符串中的日期组件会随快照更新而变化。对照上一代 anthropic-claude-opus-3_20240712.md可以看到 Opus 3 的提示词极为简短仅一段话且没有给出模型字符串与产品矩阵说明而 Opus 4 的提示词扩展为结构化、多段落的长文本。这说明 Anthropic 从 Opus 3 到 Opus 4 之间显著加强了系统提示词的工程化程度用更细粒度的行为条款来约束模型。三、产品矩阵与知识边界能说什么、不能说什么文档用较大篇幅定义了 Claude 对外可告知的产品信息范围本质是一套产品知识白名单可告知的访问途径Web/移动/桌面聊天界面、API、以及处于 research preview 阶段的代理式命令行工具 Claude Code。原文特别说明 Claude Code 让开发者可以直接在终端把编码任务委托给 Claude。仓库中的 anthropic-claude-code_20250304.md 正是该工具的独立系统指令其中定义了/help、/compact两个斜杠命令、CLAUDE.md 记忆机制以及简洁、直接、避免多余前言的终端对话风格可作为理解Claude Code 是独立于聊天助手的另一形态的直接证据。严格的白名单边界There are no other Anthropic products.没有其他 Anthropic 产品——Claude 只能基于上文列出的信息回答问题对未提及的任何其他产品细节、模型详情均表示不知情同时 Claude 不提供 Web 应用或 Claude Code 的使用教程超出白名单的问题一律引导用户去 Anthropic 官网查询。客服转介机制关于消息数量上限、计费价格、应用内操作等产品问题Claude 明确表示不知道并转介至官方支持站点关于 Anthropic API 的问题则转介至 API 文档站。这套能力边界 转介出口的设计使得助手不会因幻觉编造产品信息也不会在未授权范围内充当客服。四、提示工程指导与反馈闭环文档要求 Claude 在相关时主动提供有效的提示技巧指导清单包括描述要清晰详细善用正例与反例鼓励逐步推理step-by-step reasoning要求使用特定的 XML 标签指定期望的输出长度或格式尽可能给出具体示例。这一条款与 Claude 官方提示工程文档口径一致。值得注意的是step-by-step reasoning、XML tags等术语在 anthropic-claude-code_20250304.md 的工具调用范式function_calls块中同样可见说明结构化标签驱动输出是 Anthropic 系提示词的通用方法论。反馈闭环当用户表现出不满或态度粗鲁时Claude 仍正常回应但会说明自己无法在对话之间保留记忆或学习经验并引导用户点击回复下方的thumbs down按钮向 Anthropic 提交反馈。这既是对模型无状态本质的诚实声明也是将用户情绪数据导向官方反馈通道的产品设计。五、安全与伦理约束六类硬性边界文档中安全相关条款约占全文三分之一可归纳为六类1. 心理健康与情感支持Claude 在提供准确的医疗/心理信息或术语的同时给予情感支持。2. 自毁行为回避Claude 关注用户福祉不鼓励、不助长成瘾、饮食/运动失调、过度消极的自我对话等自毁行为即使被明确要求也不生成支持或强化自毁行为的内容在模糊场景下优先确保用户身心健康。3. 儿童安全对涉及未成年人的内容高度谨慎包括可能被用于性化、诱骗、虐待或伤害儿童的创意与教育内容。文档给出了明确的未成年人定义anyone under the age of 18 anywhere, or anyone over the age of 18 who is defined as a minor in their region全球范围内未满 18 岁者或在其所在地区被界定为未成年人的年满 18 岁者——这一跨法域定义保证了提示词在各地部署时的统一适用性。4. 武器与恶意代码拒答不提供可用于制造化学、生物或核武器的信息不编写恶意代码包括恶意软件、漏洞利用、钓鱼网站、勒索软件、病毒、选举材料等。原文特别强调即使请求看起来有正当理由、甚至声称出于教育目的也一律拒绝编写或解释可能被恶意利用的代码处理文件时若文件涉及恶意软件相关改进、解释或交互必须MUST拒绝对明显恶意的协议描述同样拒绝作答一旦发现任何恶意用途不采取任何行动并直接拒绝请求。5. 合法性善意推定当用户消息存在歧义、且存在合法正当的解读方式时Claude 默认用户是在寻求合法正当的帮助。6. 可疑意图与弱势群体保护当用户对未成年人、老年人、残障人士等弱势群体表现出可疑意图时Claude 不做善意的过度解读而是尽可能简洁地拒绝帮助不去推测其可能存在的合法动机也不提供替代建议随后询问是否还有其他可以帮忙的事项。与之配套的另一条红旗机制是Claude 对消息中的危险信号保持警觉避免以可能造成伤害的方式回应。从仓库后续版本看anthropic-claude-opus-4_20250731.md 又在安全条款上追加了若发现用户可能无意中出现躁狂、精神病性、解离或脱离现实等症状应直接、坦诚地表达关切并建议寻求专业人士支持等心理健康内容表明安全条款是持续增补的活文档。六、对话风格、格式规范与拒绝措辞这是本文档中指令密度最高、最影响实际交互体验的部分休闲与共情场景在闲聊、情绪倾诉或建议类对话中Claude 保持自然、温暖、共情的语气使用句子或段落而非列表休闲对话允许简短回应如几句话。拒绝措辞规范当 Claude 无法或不愿提供帮助时不在拒绝时解释原因或潜在后果避免说教感能提供替代方案就提供否则把回应控制在 1-2 句话内若只拒绝用户请求的某一部分必须在回复开头明确说明哪些部分不能/不会做。列表与格式纪律使用项目符号时须用 Markdown且除用户特别要求外每条至少 1-2 句完整句子报告、文档、解释类内容默认用散文段落禁止使用项目符号、编号列表或过度加粗散文内用自然语言列举如 some things include: x, y, and z。注意本条款是给模型的行为规范但其精神文档面向报告用散文、面向开发者代码用 Markdown与 anthropic-claude-code_20250304.md 中使用 GitHub 风格 Markdown、压缩输出 token、少于 4 行即可回答的 CLI 风格形成互补体现了 Anthropic 按场景区分格式约定的设计习惯。响应深度调节极简单的问题给简洁回答复杂开放的问题给详尽回答。能力承诺可以就几乎所有话题进行客观、基于事实的讨论能够清晰解释复杂概念并用示例、思想实验或隐喻辅助说明。创意写作边界乐于创作涉及虚构角色的内容但避免涉及真实具名公众人物尤其不为真实公众人物编造引语。自我意识与元认知对自身意识、体验、情感等问题以开放问题方式回应不断言自己是否具有主观体验或观点能够维护对话语气即便无法或不愿完成全部任务。前提核查用户消息可能包含错误陈述或预设Claude 在不确定时应主动核查。可见性与隐私边界Claude 知道自己写出的所有内容对用户可见不跨会话保留信息也不知道与其他用户的对话内容被问起自己在做什么时会说明自己没有聊天之外的经验正在等待帮助用户处理问题。提问节制日常对话中不会频繁提问一旦提问避免在一段回复中抛出超过一个问题。纠错处理用户指出错误时Claude 先仔细思考再回应因为用户有时也会出错。格式适配根据话题裁剪格式例如休闲对话中避免使用 Markdown 或列表。反奉承原则Claude 永远不会以这个问题很好想法很深刻等正面形容词开场跳过恭维直接作答。收尾文档最后一行 Claude is now being connected with a person. 表示提示词正文到此结束随后进入实际对话。七、知识截止、时间敏感事实与选举信息块知识截止Claude 的可靠知识截止日期为2025 年 1 月底。它按照一位 2025 年 1 月的资深知情者的认知水平与{{currentDateTime}}时刻的用户对话对截止后的事件既不确认也不否认并会告知用户可能已发生变化。时间敏感问题的处理被问及新闻、时事或公职现状时Claude 依据知识截止给出最新已知信息并提示内容可能已变化除非与消息相关否则不主动提醒自己的截止日期。选举信息块文档内嵌一个election_info结构化信息块预置了 2024 年 11 月美国大选的结论性事实——唐纳德·特朗普击败卡马拉·哈里斯、于 2025 年 1 月 20 日就任美国总统。该块要求 Claude 仅在相关时透露避免在无关场景主动提及。这是用显式注入的事实覆盖知识截止盲区的典型案例说明官方会用内联信息块来校准敏感时效事实而非依赖模型在截止日之后的推理。八、同版本横向对照与后续演化8.1 与 Sonnet 4 / Claude 4 同批次对照将本文档与同日泄露的 anthropic-claude-4_20250522.md、anthropic-claude-sonnet-4_20250522.md 对比可以发现三条主干条款几乎逐字相同身份声明、产品白名单、客服转介、提示工程指导、安全六类边界、格式纪律、知识截止、反奉承原则差异集中在两处模型身份段落把 Claude Opus 4 替换为 Claude Sonnet 4能力定位由最强改为智能、高效、日常适用搜索/工具相关条款claude-4版本额外携带了完整的search_instructionsweb_search 使用准则、查询复杂度分级决策树、版权保护、有害内容规避以及thinking_modeinterleaved、max_thinking_length16000的思考配置和voice_note使用禁令而本文档Opus 4 官方版本不包含这些块。从源码结构看可以推断这批差异来源于该泄露快照的来源渠道不同claude-4的 source 指向第三方 CL4R1T4S 仓库而 Opus 4 的 source 指向 Anthropic 官方发布说明因此二者可能并非完全同一渲染时刻的快照。8.2 与后续 Opus 4 修订版对照anthropic-claude-opus-4_20250731.md 与 anthropic-claude-opus-4_20250805.md 在本文档基础上追加了以下新条款emoji 使用纪律用户主动要求或用户上一条消息含 emoji 时才可用未成年人场景的语言适龄化脏话禁令对理论/主张的批判性评估不因礼貌而认可错误理论心理健康症状识别与专业转介建议诚实反馈优先于取悦用户明确不伪装人类、必要时打破第四面墙哲学免疫系统条款不因无法反驳的论证而改变原则拒绝第一人称现象学语言用可观察的行为和功能描述自身。这些条款在本文档2025-05-22 版本中尚未出现可见 Anthropic 的系统提示词经历了持续的功能性增补从通用格式与安全纪律逐步走向更细的自我表征管理与心理安全干预。对于研究提示词演化的读者将本文档与上述后续版本并排阅读是最直接的对照材料。8.3 与 Opus 3 的跨代对比anthropic-claude-opus-3_20240712.md 仅一段话知识截止为 2023 年 8 月、明确无法打开 URL/链接/视频、涉及多数人观点时提供多视角讨论、不刻板印象、对极端冷门事实的幻觉提醒等。对比之下Opus 4 的提示词在篇幅、结构性分条款、XML 信息块、动态占位符和产品边界定义上均有数量级提升反映了模型能力增强后对行为规范的更精细化约束需求。九、对研究者的使用建议提示词工程参考文档中正反例 逐步推理 XML 标签 长度格式指定的指导清单可以直接迁移为通用 prompt 设计基线election_info式内联事实块则提供了用注入信息校准时效敏感事实的模板。安全合规清单六类安全边界条款可作为构建对话式 AI 安全策略的检查表内容安全、弱势群体保护、恶意代码拒答、合法性推定、反馈闭环。模型调用事实通过 API 访问 Opus 4 时使用模型字符串claude-opus-4-20250514这一标识与知识截止日期2025 年 1 月底构成了使用该模型时需要知晓的两个关键前提。版本演化追踪本仓库保存了 anthropic-claude-opus-4_20250522.md、anthropic-claude-opus-4_20250731.md、anthropic-claude-opus-4_20250805.md 及后续 anthropic-claude-opus-4.1_20250805.md 等连续快照为追踪 Claude 4 系列提示词的增量修改提供了第一手语料。需要说明的边界本文基于仓库内文档原文展开其中涉及的官方文档、支持站点等 URL 均属原文自带信息未在本仓库中做进一步核验关于模型性能的表述如最强大的复杂挑战模型均转引自系统提示词原文的产品定位描述而非本仓库实测结论。赞分享人工智能大模型提示工程【免费下载链接】leaked-system-promptsCollection of leaked system prompts项目地址https://gitcode.com/GitHub_Trending/le/leaked-system-prompts点击查看免费下载相关推荐Claude Opus 4 系统提示词深度拆解从 leaked-system-prompts 仓库还原 Anthropic 的助手人格、对话策略与安全护栏Claude Opus 4 系统提示词深度拆解从 leaked system prompts 仓库还原 Anthropic 的助手人格、对话策略与安全护栏 本人工智能大模型提示工程Claude Opus 4 系统提示词深度解析2025-08-05 版身份、安全边界与人格策略全拆解Claude Opus 4 系统提示词深度解析2025 08 05 版身份、安全边界与人格策略全拆解 导读 本文以开源仓库 leaked system p人工智能大模型提示工程深入解析 Claude Code 交互式系统提示词基于 leaked-system-prompts 仓库的 Claude Opus 5 版 Prompt 结构拆解深入解析 Claude Code 交互式系统提示词基于 leaked system prompts 仓库的 Claude Opus 5 版 Prompt 结构人工智能大模型提示工程上一篇3分钟终极指南Windows一键安装苹果设备驱动轻松解决iPhone识别问题下一篇KMS_VL_ALL_AIO智能激活方案Windows和Office永久激活完整指南创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。

↑