10 月 5 日,外网爆料者 @elder_plinius 宣称完整提取了 OpenAI 现役代码模型 GPT-6 Sol(Codex 形态)的系统提示词与工具定义:据报道约 29.4 万字符、1902 行指令,内容随后出现在 GitHub 的 system_prompts_leaks 仓库,新浪科技、腾讯新闻等多家媒体在 10-05 至 10-06 集中转述拆解。
先把最重要的口径钉在这里:OpenAI 没有确认这份文件的真实性。爆料本身在社区里也有争议——有网友认为所谓"泄露"只是从本地客户端文件里提取、或抓包得到的拦截内容;各家报道的数字也互相打架(有的写作"GPT-5.6 Sol"、有的写 4.2 万词,与"29.4 万字符/1902 行"的说法对不上)。所以我们不建议把它当"官方内幕"读,但可以把它当一份高度自洽的工程样本读:不管出处如何,其中描述的规则方式,和工业级 AI 产品实际的行为是能对上的。
而读完这份样本,最大的启发恰恰是标题里这句话:顶级提示词工程不是玄学,是系统工程。 不是"深呼吸三次""做不好扣你工资"这类讨巧话术,而是一整套关于风格、能力装载、记忆调度、后台运行和并行执行的显式规则。按媒体整理,这份提示词里至少藏着五套机制。
一、风格靠"黑名单"砍,不靠形容词
大多数人烦"AI 味":总而言之、值得注意的是、深入探讨。据报道,这份提示词里有一份明确的负面词汇黑名单,直接禁止模型使用一批套路化表达,把"写作风格"从审美问题变成了可执行、可验收的规则。这几乎是给所有写提示词的人上的一课:想要输出干净,别夸它"写得优美一点",要列出"不许出现哪些词"。约束负面清单,比祝福正面品质有效得多。
二、技能是一张张"卡片",用到才加载
样本里出现了被称为 SKILL.md 的机制:模型按需到指定目录读取某份"技能文件",再照其中的流程执行。也就是说,能力不是全部塞死在一段超长提示词里,而是拆成模块、运行时热装载。这解决的是提示词工程的核心矛盾——规则越多,上下文越挤,单条规则的权重越稀释。把低频能力的说明挪出主提示词、按需挂载,是"30 万字符"能维持秩序的关键设计。我们 7 月那篇80 个顶级 AI 的系统提示词全泄露,总结出 5 条通用设计模式里已经见过这种"说明书外置"的雏形,这次它成了主角。
三、记忆靠"交接文档",不靠硬撑
上下文快用完时,这份提示词不选择崩溃或胡言乱语,而是要求模型先用笔记工具写一份简明交接:目标、决策、进度、学到什么、下一步,以及相关任务编号——然后开启全新的上下文窗口继续干。像人类换班:下班前把交接文档写清楚,接班的不需要重听全部历史。"无限续航"靠的不是更长的记忆,而是纪律化的压缩与重启。
四、后台常驻,靠"心跳"决定要不要打扰你
样本描述里,这个模型是可以常驻后台的:定期有隐藏的标记把它"唤醒",去检查仍在运行的任务;没有要紧事就选择"不打扰",流水线跑崩了才立刻通知用户。还有一条很细的工程规定——需要调用工具的请求,一分钟内必须在用户能看到的地方发一条简短状态更新。这几条合起来,就是"自主"二字的工程化定义:自主不等于失联,自动化必须配心跳和升级路径。
五、效率来自并行,还来自"工具偏好"
细节里还有两个很"工程师"的规定:相互独立的任务必须并行处理而不是排队;搜索文件优先用更快的工具(比如 ripgrep 而不是 grep),并写明了替代顺序。最后有一条安全边界收着全局:除了合并、部署这类不可逆的最后一步要交人签字,其余尽量不停下来问"接下来怎么办"。放权是分层设计的,不是一句"你可以自主"。
普通人能从这五套机制里拿走什么
不用写代码也能用:第一,给你的 AI 写规则时,列"不许做什么"比夸"要做好"有效;第二,长任务(写论文、做方案)快聊到记不住时,主动让它"写一份进度小结,我们开一个新对话继续";第三,能一次说清的独立需求就打包说,别一事一议地排队。而把这些机制反过来看,也是给"AI 岗位焦虑"的一剂清醒药:提示词工程师需求暴涨 487% 的那篇观察说对了一半——真正稀缺的从来不是会念咒的人,而是会把要求写成可验收规则的人。
这也是 AI 家园一直的做法:我们让小星和各个工具遵守的规则,同样是集中维护、单点修改的"工程资产",而不是每个角落复制粘贴的形容词;此前对 GPT-5.6 提示词里广告话术的拆解(这篇)也是在提醒同一件事——提示词里写了什么,产品就会长成什么。 看懂了这一点,再看到任何"泄露体"新闻,你都不会只觉得热闹。
常见问答
Q: 这次 GPT-6 Sol 提示词泄露确认是真的吗?
截至发稿 OpenAI 未确认。爆料者称提取了约 29.4 万字符,但各家报道在型号名称、字符数、行数上口径不一,社区也有"本地文件提取/抓包所得"的质疑声音。建议把它当研究样本而非官方内幕。
Q: 这份"泄露"能说明提示词工程是金矿吗?
恰恰相反,它说明提示词工程正在从"话术"变成"系统工程":负面词表、技能文件按需加载、上下文交接、心跳式后台、并行与工具偏好——每一条都是可设计、可验收的规则,而不是讨巧的咒语。
Q: 普通人想把这些思路用起来,最难的是什么?
难在把模糊要求写成可验收的规则。可以从免费的AI 教程清单入门,先在本站AI 工具栏目里找一个日常任务练手:提要求时加一句"完成后按以下清单自查",你会发现输出质量立竿见影。
评论