solitude23456

实测 GPT-6 Astra 踩坑:过度防御直接把代码写成了屎山

  •  
  •   solitude23456 · 2h 53m ago · 204 views
    这几天深度测了下 GPT-6 Astra ( Ultra 模式)在复杂工程下的表现,体验非常糟糕。

    核心问题在于它的过度防御机制:为了所谓的安全和容错,满篇都是死板的硬编码和极端复杂的正则校验,干活速度奇慢。写独立脚本问题不大,但在多 Agent 协同和底层链路互调场景下,它的限制策略几乎引发了逻辑降智,生成的代码死板且到处报错,死活跑不起来。

    后来换了个思路,拿中转站充了 100 块的 Opus 5.5 (验过模型指纹没问题),放开思维链让它跑。就一个下午的时间,之前跑不通的底层调用逻辑全给理顺改通了。

    日常玩具模型吹得再响,真正拉到复杂业务架构和底层代码重构里,现阶段还是 Claude 的架构理解力和落地能力更顶。
    solitude23456
        1
    solitude23456  
    OP
       2h 49m ago
    动不动就糊一堆反人类的正则表达式,宁可错杀一千也不放过一个,代码根本跑不通,TMD 越测越上火!!!!!
    dm87497
        2
    dm87497  
       2h 42m ago via Android
    astra 测过降智没
    solitude23456
        3
    solitude23456  
    OP
       2h 40m ago
    @dm87497 测了 没降智。降不降也无所谓了 o➗也不当人了现在
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2835 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 21ms · UTC 10:51 · PVG 18:51 · LAX 03:51 · JFK 06:51
    ♥ Do have faith in what you're doing.