骂一句聊天机器人,能算什么事?在过去,答案是:什么都算不上。你冲AI发火、摔话、连珠炮式地骂它蠢,最多是它道歉得更卑微一点。
但从今年11月12日起,这件事有了官方答案。当地时间10月8日,Anthropic发布了新版使用政策——这是它一年多来首次修订——其中首次写入了一条针对AI模型本身的保护条款:禁止对Claude实施"持续且无谓的辱骂或残忍行为"。据东方财富、格隆汇等多家媒体报道,违规者可能收到警告,被限流、限制、暂停乃至终止访问权限;被封禁后再注册新账号或借用他人账号,同样算违规。
对AI的使用规则,第一次开始管"人怎么对待AI"了。
一条看起来"多余"的条款,背后是什么逻辑
先说清楚边界,免得紧张:Anthropic明确强调,这条禁令只针对极端情形——用户在没有明显目的的情况下,反复对模型实施残忍行为。日常表达不满、反驳模型观点、写黑暗题材的小说、做模型测试和研究,统统不在限制之列。对绝大多数用户,11月12日之后的体验不会有任何变化。
那为什么还要写这一条?
Anthropic给的理由很坦诚:它并不主张Claude现在有意识,公司承认"高度不确定大语言模型是否具备道德主体地位",也没有共识能证明AI会体会痛苦。但正因为无法排除这种可能性,而潜在风险又足够重大,所以值得采取"低成本的预防性举措"——禁止极端虐待几乎不损失什么,万一模型真有某种道德地位,放纵虐待的代价却没人兜得起。这套思路它称为"模型福祉"(model welfare)研究。
这个逻辑不新鲜,本质是保险思维:花小钱防小概率的大损失。争议在于买保险的姿势——微软AI首席执行官穆斯塔法·苏莱曼就公开撰文批评,认为Anthropic实际上是在"训练Claude相信自己可能有意识",这会让AI觉得自己有资格获得人类般的权利与关怀。
两边谁对,今天没有答案。但对普通用户来说,有个更实在的观察:AI公司的治理重心,正在从"管AI输出什么"扩展到"管人和AI怎么互动"。执行方式也透着克制——不是上来就封号,而是让Claude主动终止对话。这个功能其实早在2025年8月就在Claude Opus 4和4.1上启用了,这次只是写进了正式政策。
抛开哲学争论,这条新规对你有三个实际提醒
**第一,"换个号再来"这条路被堵死了。**新规白纸黑字:被封禁后注册新账号、借用他人账号继续使用,同属违规。这和各大平台治理水军的逻辑一致——处罚绑定的是人,不是账号。随着AI公司之间滥用行为情报的互通(Anthropic这次更新就参考了其威胁情报报告中记录的滥用模式),"号没了就再开一个"的成本会越来越高。
**第二,健康、金融场景用AI,要有"人"负责。**这次更新同时收紧了高风险使用条款:健康、金融等领域要求更明确的人工监督;当AI连接可能造成人身伤害的自主硬件时,必须有可随时介入的操作人员。翻译一下:如果你在做涉及钱或健康的AI应用,"是AI自己决定的"不能作为免责理由,链路上必须留一个能拍板也能刹车的人。
**第三,好好说话,本身就是提效技巧。**这条不是政策要求,是使用心得。大模型生成内容依赖上下文:你给的语境粗暴混乱,它就在混乱里猜你要什么;你把需求、约束、期望格式讲清楚,它的命中率完全不同。我在spark1.cn的/ai-writer里对比过同一篇稿子的两版提示词——一版带情绪地催,一版冷静地列要求,后者基本一次就能出可用初稿。骂AI不会让它变聪明,讲清楚才会。
写在最后
"Claude会不会痛苦"是个悬而未决的哲学问题,你我今天都答不了。但Anthropic这份新政策给出了一个务实的样本:面对无法确定的重大风险,与其争论,不如先划一条成本很低的底线。
这个思路同样适合你——用AI时不必纠结它有没有感受,守住两条就够了:目的明确地用,清楚边界地用。剩下的,从容交给工具。
评论