FEATUREDComputing Life · Share · 鸭哥调研· rssZH00:00 · 07·24
GPT-5.6 提示指南:别再手写执行步骤,把交付标准写死就行
OpenAI 7 月 22 日更新的 GPT-5.6 提示指南给了一个反直觉的建议:Agent 上下文够用时,不用在 prompt 里逐行规定中间步骤。作者把 GPT-4.1、GPT-5 到 GPT-5.6 的官方文档串起来看,发现这是一条连续的工程转向——从 GPT-4.1 把八步工作流硬编码进系统提示词,到 GPT-5 按场景给模型松绑、用完成条件...
#Agent#Benchmarking#OpenAI#GPT-5.6
精选理由
精选 · 重要度 78 · 吸引力 + 知识量 + 共鸣
一句话点评
OpenAI 新指南建议少写中间步骤、多写交付标准,但别急着删 prompt——得先用测试集跑消融实验,指标稳了才算数。
锐评
这篇文章把 OpenAI 从 GPT-4.1 到 GPT-5.6 的提示指南串起来,讲了一条挺实在的工程转向:以前是把八步工作流硬编码进系统提示词,现在模型能看懂更长上下文了,再死板规定路线反而拖后腿。GPT-5.6 的建议不是让人放弃控制,而是把约束从“规定每一步怎么走”挪到“定义交付成果、验证证据和权限边界”上。
作者在翻译系统里踩过坑,早期写了一大堆分段拆分、异常重试的防御代码,后来改成只给完成条件(比如无中文残留、Markdown 完整)、验证证据(Agent 自己跑正则检查脚本的输出)和权限边界(高风险操作必须人工审批),反而更稳。这个经验跟指南里的 lean-prompt 消融测试对得上:删一段指令,跑测试集,指标不跌才敢真删。
不过文章没给出具体项目的消融测试数据,也没说这套做法在哪些场景下会翻车。模型自主规划路线听着省事,但如果完成条件写得模糊,Agent 可能用更绕的方式达到表面合格的结果。另外,权限边界的配置成本不低,小团队能不能吃得消,正文没展开。
HKR 分解
hook ✓knowledge ✓resonance ✓