卡兹克那个双向钢人 Prompt,我拿自己的问题跑了一遍
卡兹克 8 月中那篇讲 steelman 的文章,核心是一个让 AI 先把正反两边都推到最强、再只问你一个问题的 Prompt。我拿餐参 AI 要不要拆成多个 Agent 跑了一遍。它把问题从拆不拆挪到了这个项目要做多久,最后只问我一年以后还会不会继续做。

卡兹克 8 月 18 日发了一篇《一个极度实用的深度思考 Prompt》。我看完没有只是收藏,拿自己手上的一个决定跑了一遍。先说他讲了什么,再说我跑出来什么。
他的起点是推特上一条分享:别让大模型直接回答,先让它深度思考一轮。他去找了 Reddit 的原帖,开头一句是 Stop asking it for answers. Ask it to steelman your problem first. 他被 steelman 这个词卡住了,评论区又都在说原帖的 Prompt 不够 steelman。
steelman 是从 straw man 反过来造的词。稻草人谬误我们都见过:你说这台手机有点贵,对方说,哦,你看不起国产手机。你的观点被削成一个好打的版本,然后被打。钢人论证是反着来,先替对方把论点补到最强,补到比他自己说得还好,再开始判断。密尔在《论自由》里说过大意相同的话:只知道自己这边论点的人,对自己这边也知道得很少。
他把这个用到 AI 上,理由我很认同。AI 到现在最大的毛病还是顺着你说,你说什么它都觉得有道理,最新的模型也一样。钢人论证正好是治这个的。于是他写了一个双向钢人 Prompt:AI 是执行钢人论证的人,你的观点是第一个被强化的对象,反对你的观点是第二个,最后 AI 手里拿着两个最强版本再判断。
他的 Prompt 做四件事:先重述你真正想解决的问题,因为人嘴上问的和心里想解决的经常不是一回事;把支持和反对两边都推到最强;找出真正的分歧和最可能改变结论的那一两个变量;然后只问你一个问题,等你答了再给判断、理由和下一步。
照这四步,我改成了自己顺手的写法:
先别急着回答,也别默认我已经把问题想清楚了。
先对这个问题做一次“双向钢人论证”:
1. 用最完整、最有力的方式,重述我真正想解决的问题。
2. 分别给出支持我现在想法的最强论证,和反对它的最强论证。
3. 找出两边真正的分歧,以及最可能改变结论的关键变量。
4. 只问我一个最关键的问题。
等我回答之后,再给出明确的判断、理由和下一步怎么做。
我的问题是:
[粘贴你的问题]我拿的是餐参 AI 要不要拆
他自己拿它选的是公司司庆日。我拿的是餐参 AI 要不要拆成多个 Agent。
上周读完 Anthropic 的商业 Agent 指南,我把餐参 AI 按单个 Agent 加 Skills 重搭了一遍。可搭着搭着,要照顾的流程一多,拆开的念头又冒出来:每块业务一个 Agent,各管各的,看起来清爽得多。
所以问题是:现在要不要拆成多个 Agent。
我把这个问题贴给了 Claude。
它先重述了问题。重述这一步就把我拉回了原点:拆不拆是手段,我真正要决定的,是这个东西按多长的时间去做。做三个月和做三年,该选的结构不一样。
支持拆的最强理由,它给了三条:每个 Agent 的上下文独立,互不干扰;可以并行,快;出了错容易隔离,一眼知道是哪一块的问题。
反对的一边,理由和我读指南时看到的对上了:对话里的状态是共享的,拆开以后要反复把状态传来传去,一次交接可能多花好几倍 token,还多出几秒延迟;业务的边界也不像组织架构图那么整齐,一个问题常常同时要用到好几块。更要紧的是,拆开以后要维护的东西变多,而这个项目现在只有我一个人在弄。
它认定的关键变量只有一个:这个项目会不会长期做下去。短期,拆开的维护成本划不来;长期,边界问题早晚要面对。
它问我的那个问题是:一年以后,你还会在做餐参 AI 吗?
我答:会,继续做。
答完这句,判断就跟着出来了。它给的建议是:既然要长期做,现在也别急着拆。先把 Skills 的边界和评估做扎实,等某一块真的独立到可以单独交出去,再让主模型把它当成一个工具去调用,而不是现在就按业务把对话切开。
我接受这个判断。拆的念头先放下了。放下的不是拆这个选项,是现在就拆。什么时候该拆,它也给了一个信号:等某一块独立到可以单独交出去。
我为什么会想拆
想拆,不是因为读了什么新文章,是做着做着自己冒出来的。
能力一多,主模型要照顾的东西就多:这一段流程、那一段规则,都堆在一处。出了问题,得从头翻到尾,才知道是哪一块的事。这种时候,把它们分开、各管各的,是最自然的念头。
还有一个不太好意思说的原因:拆开看起来更像一个正经系统。一个模型加一堆 Skill,讲出去显得简单;一组各司其职的 Agent,讲出去显得讲究。
这个 Prompt 的第一步把这个念头戳破了。它没有直接说别拆,是先问我,这件事打算做多久。
跑完以后
跑完以后,拆不拆这件事没有再纠结。想拆的时候,我会先问自己那一句:这一块,是不是已经独立到可以单独交出去了。
这个 Prompt,我后来又拿工作上的事跑过。工作上的结论不方便写在这里,能说的是,第一步重述问题在工作里更管用。人嘴上问的和心里想解决的不是一回事,这一点在工作里比在自己的项目里更常见。
哪一步有用
跑完一遍,我觉得最有用的是第一步和第四步。第一步把问题从拆不拆,挪到了这个项目要做多久;第四步一个问题就逼出了答案。中间正反两边的论证写得都对,但对得有点整齐,像两份辩论稿,看的时候没什么感觉。真正让我动的是那个问题。
它问的也不是一个技术问题。要不要拆成多个 Agent,听起来是架构选择,最后落到的却是我愿意在这件事上花多久。想清楚这一点,架构反而好选了。
下次再拿不定主意,我大概还是会先跑这一遍。不是为了让 AI 替我决定,是让它把我不想看的那一边摆出来,然后只问一句。