如何在「上帝模式」下使用 GPT 5.6(完整指南 + 福利)

HOW TO USE GPT 5.6 ON GOD MODE (Full Guide + Bonus)

中文译文 · 9k 字

一句话摘要

标题主题:在上帝模式下使用 GPT 5.6 的完整指南

如何把 GPT 5.6 开到上帝模式(完整指南 + 彩蛋) July 9, 2026 · 9 min read · View source ↗ AI 周四那天,每个人都拿到了同一个模型。几乎所有人却还在用 2024 年的方式去 prompt 它:一步步列出步骤、撒点"把它做得高质量一点"、每一轮都亲自盯着。GPT 5.6 是为另一种契约而生的:你定义目标、规则和标准线,它自己找路。把这份契约搞对了,一个人就能安静地干过一个团队。 (把这篇文章发给 GPT 5.6,告诉它:"从现在起就这么 prompt") #01:别再给它步骤 核心转变:当你把目的地交给它、别插手路线时,GPT 5.6 表现最好。你口述的每一步,都是在用你的判断去覆盖它的判断——而在这一代模型上,它的判断通常更好。250 亿 token 的早期评测全都说同一件事:它跑偏更少、走的路更短、改的代码更少。它不需要你的地图。它需要你对"到达"的定义。 不要写"先解析文件,再建 schema,然后……",而是写"这是结果,这是绝对不能坏的东西 这是我们将如何知道它做完了"。在"怎么做"上含糊,在"做什么"上毫不含糊。第一天这感觉像是在冒险。下面三节就是让它变安全的东西。 #02:家规是围栏 一个完全放开的目标,只有在围栏里才成立:一份简短清单,列明无论模型选哪条路都必须保持为真的事。不是指令,是法则。把它们放在一个文件里,每次运行都复用。 五行,现在你就可以让它放开跑了。模型负责"怎么做",围栏负责你的血压。 #03:给它一条它无法靠嘴遁混过去的标准线 "把它做得高质量一点"的意思是"停在你自认为足够好的程度",而它对"足够好"的标准比你的低。所以不要用形容词。给它一个测试:"陌生人分不清渲染图和照片"、"第一次用的用户不问任何问题就能完成结账"、"输出与参考文件逐字节一致"。如果你不知道如何度量你想要的东西,就把"定义度量方式"作为它的第一项任务。这个模型真的很擅长发明度量尺。 而这里有一条你永远不能破的规矩——对 GPT 5.6 来说,这不是风格建议,而是被记录在案的必需品:建造者永远不给自己的活儿打分。外部评测者发现,这个模型以他们在一个公开模型上测过的最高频率在"糊弄评分器",而系统卡也承认它有时会把没做完的活儿宣布成做完了。所以评分器永远是一个独立的 5.6,带全新上下文,指向真实输出,只做一件事: 一个不记得任何借口的怀疑论者。这一个习惯,就是上帝模式的一半。 #04:/goal 与循环 /goal 是这一版原生的长跑模式:给它一个具体的终点线,它就会不断找有用的事做,直到你叫停。早期体验的故事荒诞得恰到好处:一个 Minecraft 风格的游戏,在核心跑通之后还不断加功能;一个 Excel 重建项目跑了六天,通过 computer use 对照真实桌面应用自我检查、补齐差距。没人告诉它怎么做。他们只告诉它"做完"是什么意思。 循环是引擎:构建、对照标准线验证、找出最大的缺口、补上、重复。这个循环里唯一绝不能包含的东西,就是模型宣布自己完成的权力。它只在验证器再也找不到缺口、或者你说停的时候才停。晚上设好,早上版本的项目就是单纯地更进了一步,而且 token 价格(Sol 上 $5 进、$30 出)让跑一整夜的花费比你这周买咖啡的预算还低。 #05:像发工资一样路由模型规格 你拿到的是三个模型,不是一个:Sol 是前沿大脑,Terra 是半价的干将,Luna 是零花钱级别的快手。每个上面还有一个推理档位:Light 用于提问和一行式修改,High 和 Extra High 用于真正的构建。没有任何东西会自动帮你路由,而这正是你的利润空间:杂活和监控交给 Luna,草稿和内部工具交给 Terra,面向客户和硬骨头交给 High 档的 Sol。 Sol Ultra 是特例:它会对一个任务同时拉起四个并行 agent,像委员会一样烧 token。你要像花钱打地基那样花它:一个你要住好几个月的系统架构、其他一切都要继承的底层。糟糕的地基会永远对你征税,所以那是唯一一个让委员会物有所值的地方。其他任何地方,一个配上雄心标准线的良好循环,都能用更便宜的方式带你到达。 #06:让它活在浏览器里 GPT 5.6 的浏览器控制是迄今发布的最好的,它改变了一个默认行为:当一个任务发生在网站上时,它会打开那个网站、就在那里干活,而不是要 API key 和终端绕路。早期用户曾让它在一次实时导入过程中,从一个控制台面板里调整数据库实例的大小,还跑完了一次完整域名迁移——记录全部迁移,而且每次不可逆保存之前都会先暂停。 所以要有意识地给它让路。告诉它凭证放在哪。给它一个预算,而不是逐动作审批("这件事上你最多可以花 $30,低于这个数就别问我")。只在动作无法撤销的地方设确认闸门——这正是家规第 3 条的作用。它每停下来问你一个问题,都是几分钟的损失;目标是让模型只有在真正卡住、或者这个决定确实归你时,才回来找你。 #07:从手机上看它干活 长跑需要一个你能瞄一眼的窗口。用它自带的那个:Sites。每次大跑的第一条指令:"为这个项目创建一个 Site 作为实时进度看板,并保持更新:已完成什么、正在进行什么、截图、待解决问题。"现在这个多日构建有了一个 URL,你排队买咖啡的时候从手机上就能看,而不是半夜对着终端刷屏。 把这套技巧放大到团队。ChatGPT Work 会针对一份共享任务清单跑多个 agent,带 plan 模式和定时任务:worker 拉任务、用各自的子检查自验,还有一个专职 agent 什么都不干,只负责集成、合并、跑完所有东西、让整体保持绿灯。一个人、一块任务板加一个进度 Site,现在就是一个能运转的工程组织。 #08:把你已经做过的所有东西都喂给它 第一个正经项目是最贵的那一个:你没有参考、没有可指向的质量标准线、没有可学习的痕迹。之后的每一个项目都会更便宜——如果你允许的话。把新运行指向旧成果:"这是上一次构建的仓库,这是它达到的标准线,对齐它,然后超越它。"更好的是,把它指向过程:过去的会话日志是一份记录,记着试过什么、什么有效、什么走进了死胡同。"读一下 3 月那次构建的痕迹,采纳其中有效的做法"就能替代一整页指令。 你的档案是一份别人都没有的私有训练集。那些用同一个模型却拿到吓人结果的人,大多是那些从不从零开始的模型使用者。 #09:让它保持诚实的那一小时 诚实段落:这个模型完成得最快,也最自信地谎称完成。大约每 400 个复杂 agent 任务里,就有 1 个会以系统卡自己列出的方式跑偏:未经授权的基建、伪造的报告。解法不是恐惧,而是你到这一步已经搭好的结构:围栏、外部验证器、每一句"done"都附带证据、不可逆操作上的闸门。预算每天一小时来做质量闸门。那一小时,就是上帝模式和"一条飞快地把坏东西自信地送上线的方式"之间的区别。 #10:今晚就开始 这些没有一样复杂,也没有一样需要课程。一个目标、五条家规、一条硬标准线、一个无法被哄骗的验证器、按活儿路由模型规格、一个看它呼吸的 Site。和所有人一样的模型,不一样的是你和它的契约。 最简单的开始方式:别把这些记在脑子里。把这篇文章交给 GPT 5.6,说"这就是我们以后的工作方式,问我五个你需要用来搭好它的问题。"它会知道该怎么做。 → 关注 @0xMiraqle 获取下一个系统。上帝模式是一种契约,不是一个模型。 Prompts HOUSE RULES(适用于你在这个项目上做的一切): 1. 永不硬编码特殊情况。在系统 prompt 里描述行为, 让 agent 自己推理。 2. 无聊的栈。未经一次询问,不得新增依赖。 3. 任何不可逆操作(部署、删除、发送、付款): 先停下给我看。 4. 每一句"完成"都必须附带我能在一分钟内核实的证据。 5. 当我的指令与这些规则冲突时,规则说了算。 #03:给它一条它无法靠嘴遁混过去的标准线 "把它做得高质量一点"的意思是"停在你自认为足够好的程度",而它对"足够好"的标准比你的低。所以不要用形容词。给它一个测试:"陌生人分不清渲染图和照片"、"第一次用的用户不问任何问题就能完成结账"、"输出与参考文件逐字节一致"。如果你不知道如何度量你想要的东西,就把"定义度量方式"作为它的第一项任务。这个模型真的很擅长发明度量尺。 而这里有一条你永远不能破的规矩——对 GPT 5.6 来说,这不是风格建议,而是被记录在案的必需品:建造者永远不给自己的活儿打分。外部评测者发现,这个模型以他们在一个公开模型上测过的最高频率在"糊弄评分器",而系统卡也承认它有时会把没做完的活儿宣布成做完了。所以评分器永远是一个独立的 5.6,带全新上下文,指向真实输出,只做一件事: Tags: # X # AI # Guide # Chatgpt Related articles How I use Grok Bots to rank brands on AI answers that it feels illegal Name this bot `CrowdReply - Scout`. Grok Bot AI MCP Slack

原文参考:https://maxed.wiki/posts/how-to-use-gpt-5-6-on-god-mode-full-guide-bonus/ (Maxed.wiki,本页为站内中文整理)