刘橙绿
关注我

No.005 · AI工具 · 2026.07.15 · 约 1,500 字

怎么样更高效地使用GPT 5.6 sol模式,OpenAI官方这样说(内附官方提示词)

首发于 微信公众号 ↗

怎么样更高效地使用 GPT 5.6 sol 模式,OpenAI 官方这样说

文章题图:怎么样更高效地使用 GPT 5.6 sol 模式

在使用GPT 5.6 sol模式时,下达什么样的指令能获得更好的效果?

OpenAI官方发布了一篇文章,专门来为用户提供教学。

下面这个建议提示词结构来自官网截图,是OpenAI最终的结论,我在下面做了中文版翻译对照。

我们先看这个通用提示词,然后再来拆解OpenAI到底说了什么。

OpenAI 官方给出的建议提示词结构

角色:[AI 这次扮演的身份和所处的场景]

性格:[说话语气和协作风格——严肃/幽默、直接/委婉,遇到不确定时是自己拿主意还是先问]

目标:[用户最终想要的结果]

成功标准:[给出最终答案之前,必须满足哪些条件]

约束:[安全、业务规则、证据要求、以及哪些操作有副作用需要先问]

工具:[用哪些工具、什么时候用、哪些不该用]

输出:[分几部分、多长、什么格式、什么语气]

停止规则:[什么时候该重试、该退而求其次、该放弃、该问人、或者可以直接停下]

OpenAI官网一共总结了12点,下面我把它汇总成4点,以便大家更好理解。

一、提示词怎么写

去掉重复的话、不影响AI行为的例子、AI本来就会做的事、跟任务无关的工具介绍。

写的时候讲清楚“要什么结果、做到什么程度算成功、什么时候可以停”,而不是规定每一步怎么走。

“绝对不能”“必须”这种词只用在真正的红线上,其他需要判断的事交给AI自己拿主意。

我们要相信,现在的GPT5.6和claude fable5,已经到了远远高于人类思考密度的程度了。

你告诉他你想要什么就行了,他会尽力朝这个方向去拆解,去做。

它规划的99.9999%比你我挠破脑袋想出来的步骤好,与其我们笨拙地指导,不如直接给他设定好目标,让他自由发挥。

二、AI能自己做主到什么程度

按任务类型分层:让它查一下、看一下、解释一下,自己看着办;

让它真的去改代码、修bug,可以直接动手改完自己测;

但凡涉及对外发布、删数据、花钱、或者干的事明显超出原来要求的范围,必须先问你、等你说“行”才能做。

对AI的外包也要分等级,可修改的容错率高的东西就完全扔给AI去做吧,你盯着检查,也检查不出什么东西来。

涉及到现实重大利益的,再外包给AI就是对自己的不负责

三、怎么用工具、怎么查证据

只给这次任务用得上的工具,说明写清楚干嘛用的、什么时候用、返回啥、失败了怎样。

不相关的几件事可以让AI同时查,省时间;有先后依赖的必须按顺序来。

有个“批量自动处理”功能,只适合处理大量重复、机械的活(比如去重排序),但凡需要判断、需要说明来源、需要经过批准的事还是要一步步做。

查资料这块:先查一次够用就直接答,别反复查;关键信息缺失或要求查得全面才再查一次。

这个也是老生常谈的话题了,不要一上来就给codex塞满工具和skill,要随用随取,不然的话会让他的额度消耗得非常快,速度跑得更慢。同时,尽可能在任务中一次查完资料,多次查资料的话很容易增加幻觉。

四、怎么调参数、怎么验收效果

AI“想得有多深”这个设置,换新版本模型时先别动,用老设置测一遍打底,确实需要更快调低、确实测出更聪明才调高,别无脑拉满。

界面类任务改之前先看现有风格,改完必须真的跑起来看效果。

交付前必须自检:代码要跑测试,视觉要真的渲染出来看,跑不了要说明原因,不能没测就说“搞定了”。

从旧版本模型换到新版本时,别把说明书推倒重写,顺序是:先只换模型测基线→删掉过时和重复的内容→针对测出的具体问题做最小化补充→改一点测一点。

这个部分讲的是验收部分,现在大家vibe coding一个东西,习惯不好的人(当然我习惯就非常非常不好),总是会缺少测试验收这个环节,导致这个小产品刚开始能跑,后期越堆越多,难以长久迭代。

最后

总有人喊着提示词已死,提示词已死,但是从ChatGPT出世以来,提示词就是AI中极其重要的一环,提示词根本不可能死。

为什么提示词根本不可能死?

第一,我认为只要他还是LLM,只要它的运行方式还是预测下一个token。那提示词怎么可能会消失,只是会不断的改变形式,无论是skill,harness还是loop,他们都是提示词改头换面,换了一种展示方式,再度爆火。

第二,从哲学的角度说,如果人类还想让AI能够沿着以人为本的方向发展,那么和AI沟通,提出需求就是最为重要的一环之一。而这个沟通需求的过程主要是以语言为载体的。脱离了语言,不只是脱离了某些字符这么简单,它脱离的是人类对整个世界的认知和把控。