blackantt
V2EX  ›  Claude

让同一个模型写 plan,再用它自己 review,这种有意义吗? 还是用不同的模型来 review 好?

  •  
  •   blackantt · 1 day ago · 2575 views
    Supplement 1  ·  1 day ago
    为啥用 fable5 (中间有 2 次自动降到 opus4.8 了,又给我强制回到 fable5)写的 plan ,给 sol ultra 去 review ,结果发现一大堆问题。然后把这个 review 结果又给 fable5 去看,它说 review 结果和建议都是对的!
    22 replies    2026-07-26 14:38:57 +08:00
    msg7086
        1
    msg7086  
       1 day ago
    有不同的模型对抗更好,但不意味着同一个模型就没有意义。模型切换视角也可以得出不同的结论。
    menfrexu
        2
    menfrexu  
       1 day ago
    肯定要要 cold agent review ,你自己写代码,自己 review 一样的道理会被惯性带着走
    SmiteChow
        3
    SmiteChow  
       1 day ago
    有意义,并不会更好
    fovecifer
        4
    fovecifer  
       1 day ago
    有意义,但是不如独立模型 review 好,很多文章跟实践经验都提过这一点,包括最近 A 社发布的 loop enginnering 例子
    lujiaosama
        5
    lujiaosama  
       1 day ago
    有意义。他自己能审查出缺陷,但是最好还是切换模型
    hanssx
        6
    hanssx  
       1 day ago   ❤️ 1
    哈哈,我这么玩过 2 周,你自己试试就知道了,你这么操作会无限制循环下去,gpt5.6 会一直发现问题,即使你使用/goal ,然后让它自己再 review 也会出问题,这个原因是因为它们在 review plan 的时候会丢失一些信息,所以总会发现问题,而且到最后会越改越乱。
    blackantt
        7
    blackantt  
    OP
       1 day ago
    @hanssx 那你的实践是,不要互相 review ?
    superdong
        8
    superdong  
       1 day ago
    @hanssx 同感,不知道是否有好的规避方案
    wowodavid
        9
    wowodavid  
       1 day ago via iPhone
    同一个模型 reviews 同样的代码,都会出来不同的结果,这是 llm 底层决定的,换模型会“换一个方式出错”,而不是“不出错”
    alexluo1
        10
    alexluo1  
    PRO
       1 day ago
    给你的 plan 设定一个边界,只做哪些不做哪些,我遇到过很多次这种现象,对一个小功能的 plan 不停的 review ,每次都能发现新的问题,结果变的越来越庞大,最后变成了一个完整的架构设计
    blackantt
        11
    blackantt  
    OP
       1 day ago
    @wowodavid 似乎是这样的。那咋办?
    AEDaydreamer
        12
    AEDaydreamer  
       1 day ago
    同模型 review 是有意义的, 因为提供的上下文环境是不一样的,包括一个是写代码主要输出,一个读代码主要输入,最主要的就是 prompt 不一样。
    nsjs
        13
    nsjs  
       1 day ago via iPhone
    @blackantt 很简单啊,做到你觉得可以了就停。也就是你要确定软件的边界在哪,不存在一个无限满足要求的程序
    datadump
        14
    datadump  
    PRO
       1 day ago
    前期架构用好点的 llm+肉身 review ;后期代码实现 llm 自己 review ,测试用例给足
    xsonglive491
        15
    xsonglive491  
       1 day ago
    需不需要切换 session 进行 review?
    zyl689699
        16
    zyl689699  
       1 day ago
    可能会越来越乱,我用 gpt 和 fable 就这样
    Cenat
        17
    Cenat  
       20h 25m ago
    这种互相 review 的方式 前提是你懂技术 能分辨哪些是真问题假问题 不太懂技术的话别这么搞
    wanghui
        18
    wanghui  
       19h 34m ago
    都有意义
    你写的方案/代码,自己 review ,能发现问题
    让同事帮你 review ,也能发现问题
    weixiangzhe
        19
    weixiangzhe  
       19h 12m ago
    大家真得可以不看代码用其它模型 review 吗,我还是偏古法的,我用 gpt 写的内容,我自个 review 后,然后用 opus review 出 5 6 问题,最后我只会采用 1 -2 个,其余 2-3 个我感觉都加不得,这个发现挺多次的
    JasonYip
        20
    JasonYip  
       17h 59m ago
    同模型可以让其起 subagent 审查,然后再去核验审查报告是否可信。我 GLM5.2 迭代几次是可以收敛的。个人觉得有必要和 ai 详细讨论 spec ,实现对 ai 来说太简单,更多时间其实应该是人工 review ?系统设计还是比较难的
    aero99
        21
    aero99  
       17h 3m ago via iPhone
    我已经放弃这种方法,后期分支太多多花了更多时间
    hanssx
        22
    hanssx  
       3h 36m ago
    @blackantt
    @superdong 我也不知道怎么解决,据说是信息折损问题,可能本身内容是没问题的,但是写出来的 plan 会丢东西,我现在是尽量精简单个 plan 文件,plan 拆成的 task ,一个 task 一个 session ,上下文保持在 50%以内。这些都是我瞎弄的,我也没搞明白最佳实践到底在哪儿。

    看 Matt 的视频,他也是一个 task 一个 session 。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2797 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 113ms · UTC 10:14 · PVG 18:14 · LAX 03:14 · JFK 06:14
    ♥ Do have faith in what you're doing.