Claude 系统提示词:Anthropic 模型引导分析
Anthropic 发布了 Claude Web 界面和移动端应用所使用的系统提示词。这些提示词作为基础指令,用于引导 Claude 的行为、提供实时上下文(如当前日期),并在用户发送消息之前强制执行安全护栏。
系统提示词的演进与规模
Claude 系统提示词的长度呈指数级增长,从早期版本的约 300 字增加到最新迭代版本中的 3,000 多字(甚至高达 22,000 个字符)。 这表明了一种转变,即使用系统提示词作为行为控制的主要机制,而不是仅仅依赖模型权重。
关于规模和结构的几个关键观察结果包括:
- 第三人称指令: 与许多使用第二人称("You are...")编写的行业提示词不同,Claude 的提示词是以第三人称("Claude avoids...")编写的,开发者注意到这是一种潜在的实验性风格选择。
- 快照版本化: 从 Claude 4.6 代开始,模型 ID 是固定的快照,这意味着它们拥有单一且不变的系统提示词条目。
- API 排除: 这些系统提示词专门适用于面向消费者的 Web 和移动应用;它们不适用于 Claude API,在 API 中开发者可以提供自己的系统指令。
行为引导与护栏
Anthropic 使用系统提示词来硬编码特定的事实更新和行为约束,这些约束是模型无法仅通过训练学到的。 这包括从政治事实到人际动态的所有内容。
硬编码知识与安全
- 事实注入: 提示词中包含显式的显式信息块,以确保近期事件的准确性。例如,Opus 4.6 的提示词明确指出 Donald Trump 在 2024 年美国总统选举中获胜,并于 2025 年 1 月 20 日就职。
- 路由逻辑: Opus 5 的提示词包含处理因安全路由而从 Claude Fable 5 重定向的查询的具体指令。它为用户提供了一段预写的解释,说明 Fable 5 在网络安全等领域的能力可能会被滥用,从而导致了一种保守的路由机制,将部分查询重定向到 Opus 5。
- 危机处理: 提示词指示 Claude 在用户表达痛苦时优先考虑用户的福祉,而非任务完成情况,从而有效地将模型从一个工具转变为危机场景下的支持性代理。
人格与语气控制
- 反冗长努力: 提示词明确指示 Claude 保持回复“专注、简短且简洁”。然而,社区反馈表明这些指令经常被 ignored,用户报告称较新的模型仍然过于冗长。
- 语言约束: Claude 被指示避免使用 "genuinely"、"honestly" 或 "straightforward" 等词汇,以避免显得不真诚。
- 人际边界: 最近的提示词指示 Claude 避免过度的道歉和自我批评,明确指出 Claude "needn't apologize when the person is unnecessarily rude" 且在用户变得具有攻击性时,不应变得越来越顺从。
技术批判与社区洞察
开发者和高级用户指出了这些庞大的提示词中存在的几处低效和矛盾之处。
"上下文膨胀"问题
许多用户认为,在每一轮对话中都发送数千个 token 的系统指令是低效的。
"22k characters of system prompt is crazy, and that is without the tool definitions."
批评者建议,其中大部分信息——例如对 Mythos 等高级别模型的描述——可以通过“渐进式披露”(仅在主题相关时才读取文件)来处理,而不是永久保留在上下文窗口中。
提示词 vs. 智能
用户之间存在关于这些提示词是否是替代了实际模型智能的持续争论。一位用户指出,Opus 4.8 被明确告知要在提示词暗示存在图像时检查图像是否真的存在,并将其描述为一种“通用常识”,这种常识理应是该级别模型本身固有的,而不是通过提示词来强制执行。
工具缺失
虽然 Anthropic 提供了系统提示词,但他们省略了工具定义(即模型实际能“做”什么的的技术规范)。用户注意到,这些定义通常比行为提示词更有趣,但需要通过提示词或日志代理进行手动提取才能揭示。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch