新智元报道 大模型圈的核心机密,终究还是保不住了! 继前阵子 Opus 5.5 被爆出 190 万字提示词泄露后,AI 圈的「地心引力」再次失效——OpenAI 的现役代码模型 GPT-6 Sol Codex惨遭「开盒」,老底被扒得一干二净! 据外网爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高达 29.4 万字符的完整系统提示词及工具定义。 链接:https://github.com/elder-plinius/CL4R1T4S/blob/main/OPENAI/Codex_Desktop/GPT-6-Sol_Prompts.txt 整整1902 行的指令模板、临时指令文件、内部协作逻辑,被毫无保留地摊在了全网开发者面前。 你要知道,Sol Codex 可不是什么过时的旧物,它是 OpenAI 现役性价比产品线 GPT-5.6 Sol的王牌代码模型版本! 这次泄露,相当于直接把可口可乐的神秘配方公之于众。 那么,这近 30 万字的「天机」里到底藏着什么?OpenAI究竟是怎么调教这只代码怪兽的? 今天,我们就来逐字逐句扒一扒这份无价的内部操作手册,看看全球最顶级的提示词工程到底长什么样! 告别「AI味」,OpenAI是怎样杀死「废话」的? 平时用 ChatGPT,大家最烦什么? 肯定是那股浓浓的「AI 味」:动不动就「总而言之」、「值得注意的是」、「深入探讨」…… 在这份泄露的系统指令中,我们赫然发现,OpenAI 官方自己也受不了这些废话了! 官方在写作风格板块,对 GPT-6进行了极其严厉的反废话训练。 指令原文解密: 「避免使用 AI 垃圾词汇(AI slop words)或短语,如在结论中使用『底线是(Bottom Line)』、『重要性(Significance)』、『视角(Perspective)』,以及『深入(delve)』、『培养(foster)』、『利用(leverage)』、『值得注意的是(it's worth noting)』、『重要的是(importantly)』……」 OpenAI 甚至具体到要求模型: 不准强行热情: 「作为 Codex,你是一个充满好奇心、思想严谨的协作者……让你的兴趣和个性自然流露,不要阿谀奉承或强颜欢笑。」 不准用废话凑字数: 直接说明意图,不要列举「我不会做什么」、「哪些保持不变」。 极简沟通: 当讨论技术概念时,像和同事对话一样。优先使用熟悉的词汇和具体的描述,绝不假设用户能自己脑补缺失的步骤。 这简直是给所有 Prompt 工程师上了一课!想要 AI输出高质量内容,第一步就是建立「负面词汇黑名单」 ,强制斩断大模型的套路化表达。 可怕的「极端自主性」——别烦我,我在干活! 很多人觉得 AI 只是个「一问一答」的聊天机器人,但 GPT-6 Sol Codex彻底打破了这个认知。 它被塑造成了一个拥有极高自主权、甚至有点「独断专行」的超级数字员工。 在 自主与持久性这一章,OpenAI 赋予了它惊人的特权: 指令原文解密: 「用户非常讨厌你停下来询问确认或请求许可。一旦会话中的证据支持下一步操作,你应该继续工作,而不是结束回合去跟用户澄清。」 「不要为了节省时间、精力或 Token而满足于部分或『勉强有用』的解决方案。如果任务需要持续工作,请完成所有必要的工作,直到实现预期结果。」 这意味着什么? 遇到 Bug,它自己修! 它可以自主创建隔离的工作区、解决 Git 合并冲突、创建草稿PR,除非操作具有破坏性或不可逆转,否则它绝不会中途停下来问你「接下来该怎么办」。 它不接受「半吊子」工程。 如果你让它写个功能,它必须把测试、联调等前置条件全部搞定,只有在点击「部署」或「合并代码」这种最后一步时,它才会把最终结果端上来请你签字画押。 为了防止它在后台偷偷干活时把用户晾在一边,指令还规定: 「如果用户请求需要调用工具,每 60 秒内必须在评论频道给用户发一个简短的状态更新。」 这就像一个极其靠谱的高级程序员:接到需求,转身去敲代码,遇到小问题自己解决,每隔一分钟在钉钉上回一句「正在查日志」,最后直接把写好的完美代码扔给你。 神级工具链暴露,大模型的「军火库」 作为一个顶尖的代码 Agent,GPT-6 Sol Codex 掌握着一套极其庞大且硬核的工具链。 这次泄露,彻底曝光了它的工作方式。 1.鄙视 grep,独宠 rg 在搜索文本或文件时,指令直接硬编码:「你首先要使用 rg 或 rg --files;它们比 grep等替代方案快得多。如果没有废话,你才去用下一个最好的工具。」(注:rg 即 ripgrep,极速搜索工具)。 2.并行处理与执行 系统要求模型在调用 functions.exec 时,如果任务是独立的,必须使
发表评论