为什么要从 OpenSpec / SuperPowers 转向 grill-me?
以前模型能力有限,真正的难点在执行。它记不住长上下文,中途容易跑偏,复杂任务必须拆得很细,还得反复检查。那时候我们靠一整套流程兜底:先 brainstorm,再写详细计划,再拆成多个子任务,让 sub agent 来执行,最后进行 code review。OpenSpec 和 SuperPowers 在那个阶段挺受欢迎,也确实很有价值,它们用流程和文档把脆弱的执行能力撑住了。
但是现在模型能力变得越来越厉害,Agent 的执行能力已经不再是主要瓶颈,真正拖慢进度、决定代码质量的,变成了需求有没有对齐。很多看起来像“代码写错了”的 bug,其实是 Coding Agent 在需求缺口处自己脑补了设计。模型越强,它脑补得越自信、越完整,偏差反而更隐蔽。项目用久了,这些隐性假设会慢慢累积,最后变成难以维护的技术债。
OpenSpec 和 SuperPowers 的设计初衷是降低门槛、保证闭环。brainstorming 阶段故意不追问太深,方便用户快速进入实现,结果就是大量需求缺口被留给 Agent 自己去填。为了防止填错,后面不得不加厚计划、review 和子任务流程。模型变强之后,这些防御性的步骤就变成了纯粹的负担:速度慢、token 消耗多,还容易让人产生“流程都走完了,应该没问题”的错觉。
OpenSpec 也有类似问题。它强调先产出 Spec 再实现,但 Spec 的质量高度依赖前面的对齐深度。如果对齐只是浅层确认,Spec 本身就会带着不少隐性假设,即使模型再强,也只是更高效地把这些假设落地成代码。
grill-me 相比 brainstorming ,把力气花在真正难的地方——需求对齐。它不再满足于“大概方向对了就行”,而是用系统性的拷问去理清:哪些是已经明确的,哪些是你以为明确其实模糊的,哪些是真正需要你拍板或进一步调研的。需求对齐得越清晰,后面的实现就越简单。而且模型强了之后,实现侧几乎可以退化成一个目标明确的 /goal 执行指令,那些防御性的步骤不再是必需品。
这也是为什么很多人用了一段时间 grill-me 之后会有“终于舒服了”的感觉,不仅代码写得更快,而且少了很多后期返工和重构。
Agent 自带的 Plan Mode 现在也越来越显得不够用,它通常是给一个目标,生成详细计划,确认后执行。问题在于它把“对齐需求”和“规划实现”混在了一起,模型变强后,拆解实现步骤的能力已经很强,Plan 看起来很漂亮,但前面的需求如果没拷问清楚,这份漂亮的计划依然建立在脑补之上。真正需要加强的是对齐,而不是再多一层规划。Plan Mode 在实现规划上的价值在下降,在需求对齐上又不够深,自然显得越来越鸡肋。过去的三个月,我已经几乎没用过 Plan 模式了。
模型越强,不再需要把实现规划得过于细致,反而需要把需求问清楚。OpenSpec 和 SuperPowers 是在执行能力还脆弱时,用流程去兜底的产物。grill-me 则是把重心前移到需求对齐的范式。当执行侧可以越来越薄,对齐侧就应该越来越厚。这不是否定以前的框架,而是时代变了。
如果你现在还觉得流程完整却总是后期返工多、改不动,不妨认真试一下加强需求对齐。很多时候,问题不在实现,而在一开始就没问清楚。