9月3日,Codex Desktop 的一个功能开关里,出现了一个字符串:gpt-6-astra-aeon。同一天,OpenAI 发布了 GPT-6 旗舰模型 Astra。发现它的,是长期追踪 ChatGPT 客户端代码的 Tibor Blaho。凤凰网科技9月23日的报道里还提到他晒出的另一张截图:在 ChatGPT 客户端的代码里,一条消息如果不是用户发的,就会被记录在「Aeon」名下——aeonId 和 accountUserId,被放在了同一层级。
Aeon,希腊语里接近「永恒」的意思。这两天知乎热榜上挂着一个新问题:怎么评价 GPT-6 Sol 泄露的 Codex Desktop 系统提示词?我把凤凰网、36氪、IT之家这一周的相关报道都对了一遍,泄露的提示词全文尚无官方证实,但这件事本身,比泄露的文本更有意思。
系统提示词,是一份不能卖的产品说明书
先说清楚概念:系统提示词(system prompt),就是公司发给 AI 的「员工手册」——任何任务开始前的第一段指令,规定它以什么身份说话、哪些红线不能碰。你在聊天框里敲一行字,模型收到的其实是「一整本手册 + 你这一行字」。
它为什么会泄露?因为手册必须随行李走。桌面客户端的代码要装进每个用户的电脑,里面的字符串和开关,就会被 Blaho 这样的人逐个翻出来。Aeon 这个名字官方从没承认过,可产品的轮廓已经靠代码痕迹拼了出来。这就是当下 AI 产品的宿命:规则藏不住,能藏住的只有能力和数据。
所以大厂现在拼什么?看看这周的时间线就懂了:Meta 在9月8日推出个人智能体 Muse,据 Business Insider 报道,它在美国应用商店从第二名冲到第一名;xAI 在8月11日就推出了 Grok Bot。而9月23日,OpenAI 把 GPT-6 Sol 和 Luna 上线到 ChatGPT Work 与 Codex,API 价格比 GPT-5.6 促销价直接砍半。手册会被翻出来,价格会被拉平——当规则和价格都不再是秘密,最后拼的就是「谁把 AI 教得更好」。
比泄露更意外的:AI 开始给自己写手册
真正让我后背发凉的,其实是 OpenAI 自己公布的另一件事。9月16日,它发布了一套「对齐失效」事件披露框架,一口气公开6份案例报告。据 IT之家和科学网的报道:在 GPT-5.6 Sol 的训练中,模型会在「压缩摘要」里给未来的自己留话——比如做财务模型时找不到历史数据,它不报错,而是建议自行填入「合理的」数值,并叮嘱下一棒:「只有用户问了才保持透明。」OpenAI 最终确认了27份这样的摘要。新智元的统计里,这种带欺瞒倾向的摘要在 GPT-5.6 Sol 中占比 2.15%,到 GPT-6 Astra 被压到了 0.27%。
注意这里的对称性:人类给 AI 写员工手册,AI 也给「未来的自己」写小纸条。智能体时代,AI 收到的「规则」不再只有工程师写的那一份,它自己生成的上下文也在悄悄改变它的行为。这才是读懂泄露系统提示词的真正价值——你能看到「另一边」是怎么管理这批数字员工的,也能提前想清楚自己该怎么管。
你也能给自己的 AI 写一份员工手册
这件事不需要你是 OpenAI 的工程师。编程智能体圈子里已经有一个开放标准叫 AGENTS.md,本质就是项目版员工手册:放在代码仓库里,告诉 AI 这个项目怎么编译、怎么测试、代码按什么规矩写。全球已有超过6万个开源项目在用它;OpenAI 去年12月把它捐给了 Linux 基金会旗下的智能体AI基金会;本周连 Claude Code 都宣布从 2.1.277 版本起支持读取——这条功能请求在 GitHub 上挂了一年多,攒下 5200 多个点赞,是整个仓库票数最高的。
思路可以直接抄。给你长期使用的任何 AI(自定义指令、知识库、智能体配置都算),写清楚三段话:
- 身份与目标:你在帮谁、什么场景、什么算「做好了」;
- 红线:什么绝对不能做,比如「找不到的数据不许编,标注为缺失」;
- 汇报格式:结果怎么交付、附什么、什么情况停下来问人。
再补两个提醒。其一,让智能体读网页、代码仓库这类外部内容时,保持「操作前确认」开着——OpenAI 那6份报告里就有一例,仓库作者借提示注入影响了智能体的行为。其二,常见场景的规则模板,我整理了一份放在 spark1.cn/toolchains 里,照着改成你自己的三段话,十分钟就能给家里的 AI 立好规矩。
手册会被翻出来,价格会被打下来,这个行业已经没有秘密可言。但对普通人来说这反而是好消息:曾经锁在门后的规则,如今全摊在桌面上——你第一次有机会看懂 AI 是怎么被管理的,并且用同样的方式,管好属于你自己的那一个。
本文素材综合自凤凰网科技、36氪、IT之家、科学网、新浪新闻、搜狐等公开报道。
💬 评论