体感上后端代码Claude opus5.5是完全不如gpt6.1的

路人甲 2026-10-01 19:46 1

佬友们有这种感觉吗? 用opus5.5写的后端会遗漏特别多的细节 只有前端效果好 而数据库 性能算法相关的后端代码 gpt写的最稳 除了前端比较弱 前端不如国模glm5.3flash

最新回复 (19)
  • 台湾鼠鼠 10-01 19:47
    1楼

    (帖子已被作者删除)

  • kimi 10-01 19:47
    2楼

    后端会遗漏特别多的细节



    Opus5.5后端会遗漏特别多的细节 X

    GPT 是 细节狂魔 O

  • zzynb 10-01 19:48
    3楼

    不降智的Astra或者6.1sol确实后端更强一点

  • 91kevinshi 10-01 19:48
    4楼

    gpt 就是纯力工、老师傅

    但死脑筋

    开放性项目让 opus 出方案,让他监督,让 gpt 去干活

  • taylor 10-01 19:49
    5楼

    高情商:细节狂魔;低情商:防御性编程拉满

  • tanrenjun 10-01 19:50
    6楼

    gpt6.1-sol用起来确实不错,我在opencode中用起来很舒服。比Codex好用多了。 ^-^

  • kimi 10-01 19:55
    7楼

    前端比较没问题,只是因为前端通常有后端的数据流指引,所以取到什么做什么

    而且前端比较容易直觉观察到问题


    从GPT5 开始,GPT就进入疯狂查核的做法

    到GPT5.2到了极致,之后5.3 codex 、5.4 、5.5、5.6、6 一直尝试平衡


    但这也是GPT的独特之处,

    所以GPT的代码可能设计烂,可能屎山,

    但跑出来一直都是比Claude稳


    你有用过Fable + Opus + Astra + sol 的多模型协作就会知道

    即使Fable也会漏掉很多sol 能找得到的问题


    但这是取舍

    Claude就是有那个灵性,可以避免过度设计,但取舍是很多edge case或交互行为没GPT仔细

    GPT就是慢、兜底,但做出来的系统一般都比较稳


    你作为人,就是要做 帮Claude 补漏,或告诉GPT边界的人,或作为同时使用两者的平衡管理

  • allinai 10-01 19:56
    8楼

    佬,有和sonnet 5.5 模型比较吗?

  • kimi 10-01 19:57
    9楼

    gpt 去干活



    gpt 去干活,就会屎山

    用Fable做review 保证会出问题


    正确做法就是Fable 设计,Astra做复核,Opus实作,Astra/ sol 6.1 做review

    需要时你做裁决及介入(介入避免GPT又无限过度设计)

  • Hifumi Mizuhara 10-01 19:58
    10楼

    什么时候能不降智再说吧…降智很大程度上败坏了对GPT6系列的印象

  • yyf 10-01 19:58
    11楼

    如果给足够多的细节,是不是 ds4.1f 都够了?

  • 91kevinshi 10-01 20:00
    12楼

    对,这也是为什么 gpt 挨骂

    如果要用户把什么都说的那么准

    那为什么不用更便宜的模型

  • 91kevinshi 10-01 20:00
    13楼

    我是 claude 直接派发 codex 干活

    互相校验

  • kimi 10-01 20:02
    14楼

    codex



    codex写的代码很屎山,架构很冗余

    Claude做的比较合理工程设计

    而且与Claude讨论架构,比较讲人话也比较不会死脑筋

  • 海森堡 10-01 20:04
    15楼

    我是opus干活,每次提交前让gpt review,然后opus一直修改直到没问题

  • 还想成为88VIP 10-01 20:05
    16楼

    幻觉,漏细节,过度自信,不靠谱不是A家模型传统艺能吗

  • 91kevinshi 10-01 20:05
    17楼

    opus 5.5 显著好了很多

    我做了 stop hook 用不同的模型审查是否有幻觉

  • lucas 10-01 20:08
    18楼

    opus 5.5适合写原型,这是个写原型特别猛的模型,但是真落地总会有意想不到的mismatch情况,这也是小模型的病症了,Gpt写原型太慢太拖拉,也就是有大家广为流传的防御性编程问题。搞得人也很难受,但二者其实写清楚文档和约束表现都还可以。如果是裸跑想落地建议先opus实现原型然后就让gpt大人帮你做好兜底。算是一个不错的trade off

  • Caldey 10-01 20:09
    19楼

    opus5.5/fable适合干架构 每次next to do都非常合理

    astra/sol6.1适合当经验丰富的老程序员 完成各种繁琐的测试和代码验收 维护屎山

    让gpt设计架构会充满大量毫无意义的防御性代码 让claude维护屎山会遗漏细节

    总之两个模型特色侧重比较鲜明吧 适合的场景不太一样

* 帖子来源Linux.do
返回