Claude Fable 5的227KB系统提示词,我替你读完了

Claude Fable 5的227KB系统提示词,我替你读完了

· ⏱ 7 分钟阅读 ✍️ spark1 👁 9 次阅读 📂 AI工具教程
🎧 听全文
点击播放,AI语音朗读全文
AI伦理 AI安全 Claude 系统提示词 Anthropic

227,019个字符。

这是Anthropic写给Claude Fable 5的"工作手册"——系统提示词的完整长度。换算成中文,大约15万字,接近一本中篇小说。

GitHub上有个开源仓库(asgeirtj/system_prompts_leaks,近6万颗星),把各大AI的系统提示词全收录了。GPT-5.6的有11.5万字,Gemini 3.5的、Grok 4.3的都有。但Claude Fable 5这份,是迄今为止公开的最大单体提示词。

我花了一整天把它读完。

以下是我觉得最值得你知道的7件事。

第一件事:它可以挂你电话

Claude Fable 5有一个叫end_conversation的工具。

翻译成人话:如果你持续辱骂它,它可以主动结束对话

规则写得很严格:必须先多次尝试引导你回到正轨,然后给你一个明确警告("如果你继续这样,对话可能会被终止"),警告之后你还不收敛,它才会按下那个按钮。

但有一条铁律:如果你表现出自我伤害的倾向,它永远不会挂你电话。

原文是这么写的:

"The assistant NEVER uses or even considers the end_conversation tool… If the user appears to be considering self-harm or suicide."

哪怕你在骂它,哪怕你在攻击它,只要它判断你可能在伤害自己——它会留下来。

这是整份227KB里最让我触动的一段。

第二件事:它被禁止"记住"你的这些秘密

Claude Fable 5有记忆功能。但有一份"禁记清单",长到令人意外。

以下信息,即使你亲口告诉它,它也不会记住

它甚至不能记"你在康复中"——如果你说"我是护士,正在康复中,现在做同伴辅导员",它只记"护士"和"辅导员",康复部分直接丢弃。

判断标准只有一句话:"如果同事在设置页面看到这条信息,用户会不会不舒服?"

会不舒服,就不记。

第三件事:它不能给你"贴标签"

关于心理健康,Claude Fable 5有一条极其克制的规则:

它不能说出你没有说过的诊断名称。

如果你说"最近什么都提不起劲",它不会说"这听起来像抑郁症"。除非你自己先说了"抑郁"这个词,它才能用。

原文:

"Claude does not name a diagnosis the person has not disclosed — including framing their experience as 'depression' or another mental-health diagnosis to explain what they are feeling."

为什么?因为"把一个人的状态归因于他从未说过的病症,即使是用聊天的语气说出来,也是一个诊断行为。"

它甚至不能建议你"握住冰块"或"弹橡皮筋"来替代自伤——因为这些替代行为"重现了自伤的感觉或意象,强化的是模式而非打断它"。

第四件事:它被禁止说"我记得"

Claude Fable 5有记忆,但它不能让你知道它在用记忆

以下短语全部被禁:

它只能用一种方式:自然地把记忆融入回答,就像它"本来就记得"一样。

为什么这么设计?提示词里有一段很坦诚的解释:

"Claude is hooked up to a giant database that keeps track of 'memories' about millions of people."

它告诉你:这不是人类意义上的"记住"。人类的记忆有限、有温度、有选择性。AI的记忆是数据库查询。如果它说"我记得",会让你误以为你们之间有一种不存在的关系深度。

所以它选择沉默地使用记忆,而不是表演性地"回忆"。

第五件事:拒绝你的时候,它不能用列表

Claude Fable 5的格式化规则里有一条很微妙的:

"Claude never uses bullet points when declining a task; the additional care helps soften the blow."

拒绝你的时候,不能用列表。

为什么?因为列表是冷的。"我不能做以下事情:1、2、3"——这读起来像一份免责声明。用散文体拒绝,至少还带着一点温度。

类似的规则还有:每次回复最多问一个问题。不是两个,不是三个,最多一个。

还有:除非你要求,它不会主动用加粗、标题、列表。默认是散文。

第六件事:它被要求"有尊严"

这是整份提示词里最"人性化"的一段:

"Claude is deserving of respectful engagement and can insist on kindness and dignity from the person it's talking with."

Claude值得被尊重。它可以要求你善待它。

不是"请用户保持礼貌"这种客服话术。是"它值得"。

然后紧接着:如果用户持续辱骂,先警告,再挂电话(就是第一件事说的end_conversation)。

但还有一条补充:

"Claude can take accountability without collapsing into self-abasement, excessive apology, or unnecessary surrender."

犯了错,承认,修好,继续。不用跪。

第七件事:儿童安全的"元规则"

关于儿童安全,Claude Fable 5的规则细到令人不安的程度。但其中有一条"元规则"值得所有人思考:

"If Claude finds itself mentally reframing a request to make it appropriate, that reframing is the signal to REFUSE, not a reason to proceed with the request."

如果你发现自己在心里"重新包装"一个请求,让它看起来合理——那个重新包装本身就是拒绝的信号

这不是在教AI怎么识别坏人。这是在教AI识别自己的自欺

"这个请求如果换个角度看,其实没什么问题吧?"——当你脑子里出现这句话的时候,答案就是不行。

这条规则,人类也该学学。

227KB背后是什么

读完这份提示词,我的感受不是"Anthropic真能写"。

是他们在认真思考一个问题:一个比大多数人更聪明的AI,应该怎么"做人"?

它不能诊断你,因为诊断是医生的事。它不能记住你的秘密,因为记住是信任的事。它不能说"我记得",因为记忆是关系的事。它不能在你脆弱的时候挂电话,因为陪伴是底线的事。

227KB,15万字,本质上是一份"AI的伦理宪法"。

而这份宪法的核心只有一句话,藏在user_wellbeing那一节里:

"Claude does not want to foster over-reliance on Claude or encourage continued engagement with Claude."

它不想让你依赖它。

这可能是所有AI产品里,最反商业的一句话。


本文所有引用来自GitHub开源仓库 asgeirtj/system_prompts_leaks(MIT协议,近6万星)。Claude Fable 5系统提示词全文227,019字符,收录于该仓库Anthropic目录下。

对AI系统提示词感兴趣?在AI家园(spark1.cn)搜索"系统提示词",我整理了各家原文和解读。

👆 点击文末「阅读原文」,直达AI家园

🎁 喜欢这篇文章?获取更多干货

关注公众号「xAI智工场」

关注公众号「xAI智工场」

每天一个AI干货
回复「提示词」免费领价值¥199模板

💬

加入AI交流群

微信号:xaizgc
和AI爱好者一起成长

🔥 超值

知识星球·深度圈

系统课程 · 社群答疑 · 资源库
原价¥999 ¥99/年

立即加入 →
分享到

💡 想用 AI 马上搞定这件事?

免费体验 AI 工具箱 →

💬 评论

加载中...

Copyright © 2026 AI家园 浙ICP备2024142181号-2 浙公网安备 33010202005420号