上周面了个履历特别漂亮的候选人——大厂背景,做过 Agent 项目,写了满满一页技术栈。我问他:"你这个 Agent 怎么做执行规划的?"他愣了一下,然后说:“就……调 LLM 生成步骤啊。”我又问:“那如果 LLM 生成的步骤漏了关键环节呢?或者生成了一堆不相关的步骤?”“呃……重试几次?”我差点没绷住。这已经是我这个月听到的第 8 个类似的回答了。大家好像都觉得"规划 = 调 LLM",但面试官想听的远不止这些。我踩过的坑:规划全靠 Prompt 堆我自己的第一个 Agent 项目,规划环节就是一段 prompt:"请根据用户的问题,列出需要执行的步骤。"看起来没毛病对吧?结果上线第一天就翻车了。用户问:“帮我调研一下竞品公司的产品功能,出个对比报告。”我的 Agent 直接生成了 12 个步骤,从"搜索竞品官网"到"整理产品功能列表"到"分析定价策略"到"写报告"——看起来挺全的。但执行到第 5 步的时候,发现第 2 步"搜索竞品官网"只搜到了公司介绍页,没搜到产品功能页。然后 Agent 就卡在那了,不知道下一步该干啥。我当时就蹲在工位前,看着日志里 Agent 来回重试了 5 次同一个搜索,差点把 API 额度打爆。后来我才意识到:一个好的规划,不是"列出一堆步骤",而是"知道每一步需要什么、每一步的产出是什么、每一步失败了怎么办"。G4C 框架:把规划从"黑盒"变成"白盒"后来我跟一个在谷歌做研究的同学聊,他给我推荐了 G4C 框架。说人话就是四个问题: