九月的新闻里,这条大概是最让人哭笑不得的一条:浙江嘉善的史先生把AI软件"豆包"告上了法庭,而他的起诉状,正是豆包代写的。
我把浙江嘉兴市新闻传媒中心《小新说事》的首发报道,以及网易、凤凰网等媒体的转述翻了一遍,事情的时间线是这样的——
今年4月17日,史先生的母亲突发疾病过世。他老家在江苏沭阳,如今在嘉善生活,家里兄弟姐妹五个,他排老五。按老家习俗,过世三天下葬,可哥哥提议的4月20日是第四天,他觉得不对。当务之急要定一个"黄道吉日",他想到了平时"比较相信、觉得它什么都懂"的豆包。豆包推荐了4月19日,他觉得"讲得很有道理",就这么定了。
后来再问,豆包的说法却变了——黑龙江网的报道标题点得很直白:"豆包选下葬时间两次结果不同"。史先生发现19日并非黄道吉日,可丧事已经安排妥当,再改就很麻烦了。更糟的是,葬礼过后一位亲戚出车祸重伤,家人埋怨安葬日不对、破坏了"风水"。史先生向软件公司投诉,没收到回复,于是决定起诉,诉求是赔礼道歉、赔偿损失。怎么告、告谁、一步一步怎么办?也是豆包教的。目前,嘉善县人民法院已经开庭审理了这起案件。
AI为什么两次改口
很多人第一反应是豆包"骗人"。但这件事真正戳中的,是大语言模型和黄历这种工具的本质区别。
传统软件是查数据库:输入日期,输出固定结果,问一万次都一样。大语言模型是按概率"生成"回答。对代码、数学这类可验证的问题,生成和查询的效果差别不大,我们就忘了它其实并不"知道"答案。而"黄道吉日"恰恰是个没有标准答案的问题——不同版本黄历、不同流派的说法本来就可能打架。AI面对这种问题,不会说"我不知道",只会流畅地给出一个"看起来最有道理"的答案。所以它两次都答得笃定,两次还不一样。
这不是哪一家的毛病,是所有大模型的共性:语气越流畅,越不代表有依据。
官司未必赢,但开庭本身就是大事
豆包的用户协议写得清楚:生成内容仅供参考,不作为专业建议;涉及产生重大影响的情形应咨询相关专业人士,据此作出的判断和操作,后果与责任由用户自行承担。报道里律师也判断,史先生要胜诉,得证明AI软件服务方存在过错,有相当难度。长沙晚报的评论文章说得更不客气,把它和近期几起纠纷归为一类,批评"谁闹谁有理"的心态。
道理上都对。但我还是想说句公道话:一个普通人和一款国民级AI应用的纠纷,能走到法院开庭审理这一步,本身就有标本意义。每一项新技术的责任边界,都不是厂商声明划出来的,而是一个个具体案件磨出来的。这起案子的判决,未来会被无数次"听AI的出了事,谁负责"的争论引用。无论输赢,它都值得我们记下来。
让AI帮你办大事之前,先过三道问
对普通人来说,真正的教训不是"别用AI",而是搞清楚AI能管什么、不能管什么。我给自己定了三道问,也分享给你:
一问:这个答案可验证吗? 代码能跑、数学能验、日期能对着权威黄历查——可验证的事,放心让AI干,错了当场就能发现。
二问:这个问题有权威出处吗? 法律、医疗、投资、民俗,这类"专家之间都未必有共识"的问题,AI只能当线索员,不能当决策者。它给你的每一个笃定答案,都值得追问一句:"依据是什么?请列出具体来源。"然后再拿第二个工具交叉验证。我平时把各类查询、验证工具收在 spark1.cn/tools 目录里,交叉核对早就是日常操作。
三问:如果它答错了,后果我扛得住吗? 史先生的错不在于问了AI,而在于把一件"大事"的决定权整个外包了出去,还跳过了家人商量和老黄历核对这两道最朴素的验证。
AI的强项,是帮你把流程跑得更快;你的强项,是为结果负责。各司其职,才谈得上从容。
💬 评论