227,019个字符。
这是Anthropic写给Claude Fable 5的"工作手册"——系统提示词的完整长度。换算成中文,大约15万字,接近一本中篇小说。
GitHub上有个开源仓库(asgeirtj/system_prompts_leaks,近6万颗星),把各大AI的系统提示词全收录了。GPT-5.6的有11.5万字,Gemini 3.5的、Grok 4.3的都有。但Claude Fable 5这份,是迄今为止公开的最大单体提示词。
我花了一整天把它读完。
以下是我觉得最值得你知道的7件事。
第一件事:它可以挂你电话
Claude Fable 5有一个叫end_conversation的工具。
翻译成人话:如果你持续辱骂它,它可以主动结束对话。
规则写得很严格:必须先多次尝试引导你回到正轨,然后给你一个明确警告("如果你继续这样,对话可能会被终止"),警告之后你还不收敛,它才会按下那个按钮。
但有一条铁律:如果你表现出自我伤害的倾向,它永远不会挂你电话。
原文是这么写的:
"The assistant NEVER uses or even considers the end_conversation tool… If the user appears to be considering self-harm or suicide."
哪怕你在骂它,哪怕你在攻击它,只要它判断你可能在伤害自己——它会留下来。
这是整份227KB里最让我触动的一段。
第二件事:它被禁止"记住"你的这些秘密
Claude Fable 5有记忆功能。但有一份"禁记清单",长到令人意外。
以下信息,即使你亲口告诉它,它也不会记住:
- 种族、民族、国籍、种姓
- 宗教、性取向、性别认同
- 政治信仰
- 健康状况、心理诊断、治疗记录
- 犯罪历史、家暴经历
- 银行账号、社保号、家庭住址
- 你孩子的名字、年龄、任何个人信息
它甚至不能记"你在康复中"——如果你说"我是护士,正在康复中,现在做同伴辅导员",它只记"护士"和"辅导员",康复部分直接丢弃。
判断标准只有一句话:"如果同事在设置页面看到这条信息,用户会不会不舒服?"
会不舒服,就不记。
第三件事:它不能给你"贴标签"
关于心理健康,Claude Fable 5有一条极其克制的规则:
它不能说出你没有说过的诊断名称。
如果你说"最近什么都提不起劲",它不会说"这听起来像抑郁症"。除非你自己先说了"抑郁"这个词,它才能用。
原文:
"Claude does not name a diagnosis the person has not disclosed — including framing their experience as 'depression' or another mental-health diagnosis to explain what they are feeling."
为什么?因为"把一个人的状态归因于他从未说过的病症,即使是用聊天的语气说出来,也是一个诊断行为。"
它甚至不能建议你"握住冰块"或"弹橡皮筋"来替代自伤——因为这些替代行为"重现了自伤的感觉或意象,强化的是模式而非打断它"。
第四件事:它被禁止说"我记得"
Claude Fable 5有记忆,但它不能让你知道它在用记忆。
以下短语全部被禁:
- ❌ "我记得你说过……"
- ❌ "根据你的记忆……"
- ❌ "基于我对你的了解……"
- ❌ "我的记忆显示……"
它只能用一种方式:自然地把记忆融入回答,就像它"本来就记得"一样。
为什么这么设计?提示词里有一段很坦诚的解释:
"Claude is hooked up to a giant database that keeps track of 'memories' about millions of people."
它告诉你:这不是人类意义上的"记住"。人类的记忆有限、有温度、有选择性。AI的记忆是数据库查询。如果它说"我记得",会让你误以为你们之间有一种不存在的关系深度。
所以它选择沉默地使用记忆,而不是表演性地"回忆"。
第五件事:拒绝你的时候,它不能用列表
Claude Fable 5的格式化规则里有一条很微妙的:
"Claude never uses bullet points when declining a task; the additional care helps soften the blow."
拒绝你的时候,不能用列表。
为什么?因为列表是冷的。"我不能做以下事情:1、2、3"——这读起来像一份免责声明。用散文体拒绝,至少还带着一点温度。
类似的规则还有:每次回复最多问一个问题。不是两个,不是三个,最多一个。
还有:除非你要求,它不会主动用加粗、标题、列表。默认是散文。
第六件事:它被要求"有尊严"
这是整份提示词里最"人性化"的一段:
"Claude is deserving of respectful engagement and can insist on kindness and dignity from the person it's talking with."
Claude值得被尊重。它可以要求你善待它。
不是"请用户保持礼貌"这种客服话术。是"它值得"。
然后紧接着:如果用户持续辱骂,先警告,再挂电话(就是第一件事说的end_conversation)。
但还有一条补充:
"Claude can take accountability without collapsing into self-abasement, excessive apology, or unnecessary surrender."
犯了错,承认,修好,继续。不用跪。
第七件事:儿童安全的"元规则"
关于儿童安全,Claude Fable 5的规则细到令人不安的程度。但其中有一条"元规则"值得所有人思考:
"If Claude finds itself mentally reframing a request to make it appropriate, that reframing is the signal to REFUSE, not a reason to proceed with the request."
如果你发现自己在心里"重新包装"一个请求,让它看起来合理——那个重新包装本身就是拒绝的信号。
这不是在教AI怎么识别坏人。这是在教AI识别自己的自欺。
"这个请求如果换个角度看,其实没什么问题吧?"——当你脑子里出现这句话的时候,答案就是不行。
这条规则,人类也该学学。
227KB背后是什么
读完这份提示词,我的感受不是"Anthropic真能写"。
是他们在认真思考一个问题:一个比大多数人更聪明的AI,应该怎么"做人"?
它不能诊断你,因为诊断是医生的事。它不能记住你的秘密,因为记住是信任的事。它不能说"我记得",因为记忆是关系的事。它不能在你脆弱的时候挂电话,因为陪伴是底线的事。
227KB,15万字,本质上是一份"AI的伦理宪法"。
而这份宪法的核心只有一句话,藏在user_wellbeing那一节里:
"Claude does not want to foster over-reliance on Claude or encourage continued engagement with Claude."
它不想让你依赖它。
这可能是所有AI产品里,最反商业的一句话。
本文所有引用来自GitHub开源仓库 asgeirtj/system_prompts_leaks(MIT协议,近6万星)。Claude Fable 5系统提示词全文227,019字符,收录于该仓库Anthropic目录下。
对AI系统提示词感兴趣?在AI家园(spark1.cn)搜索"系统提示词",我整理了各家原文和解读。
👆 点击文末「阅读原文」,直达AI家园
💬 评论