
被 Agent 一本正经地坑过几次之后我现在几乎不会让它直接回答问题了。我会默认加上一句话。让它在回复前先做第一性原理分析和对抗式审查。不是我喜欢把 Prompt 写复杂而是真的被坑过好几次。Agent 有个很麻烦的地方它说错话的时候语气可能和说对话时一样笃定。一个未经确认的功能、一段没有真正检查过的代码、一个只是猜测的原因都可能被它讲得有理有据。严格来讲这不一定是在故意说谎。证据不足时它可能会根据训练中学到的模式生成一个听起来合理的答案。可一旦用户照着答案行动结果还是一样。错误被说得像事实。后来我慢慢意识到与其等它回答完再追问一句「你确定吗」不如一开始就要求它先怀疑自己。我在这里说的第一性原理就是让它把问题拆回最基本的事实。目标是什么已经确认了什么哪些只是默认前提哪些信息还不知道。先把地基露出来。在我的使用里不少看起来很完整的结论自己就站不住了。对抗式审查则是让它故意站到自己的对面。假设最初的判断是错的再去寻找反例、冲突证据、替代解释和可能失败的地方。尤其在写代码、查 Bug 或做方案时我会让它主动检查最新代码、日志和真实数据而不是顺着第一感觉继续编下去。我想要的不是一个更会说服我的 Agent而是一个更愿意推翻自己的 Agent。现在我常用的 Prompt大概是这样。回答前请先从第一性原理拆解问题明确目标、已知事实、关键假设和未知信息。形成初步结论后再进行一次对抗式审查主动寻找反例、冲突证据、替代解释和失败条件。请把事实、推断和未验证内容分开标注能通过代码、日志、数据或可靠来源验证的内容先验证没有条件验证则明确说明。若初步结论经不起审查请直接修正不要为了保持前后一致而辩护。当然这段 Prompt 也不能保证 Agent 永远不犯错。它只是多加了一道刹车。真正重要的结果还是要看来源、看代码、看数据。但我自己的感受是这个小习惯确实能挡掉不少「听起来很对」的答案。Agent 可以很聪明。但别忘了让它先学会怀疑自己。你有没有被 Agent 一本正经地坑过评论区聊聊我每条都看。顺手点个赞点个在看星标⭐加一个下次更新第一时间见。谢谢你看我的文章我们下次再见。/ 作者卡卡罗特 / 投稿或爆料请联系邮箱19331922086163.com