我准备放弃国产模型了

findeveloping 2026-09-22 14:11 1

用deepseek v4.1 flash花了12亿token做了个小软件,让Astra Medium审查,一下就发现了7个大bug

最新回复 (19)
  • 时牧 09-22 14:12
    1

    反过来会比较好用,让astra来做,4.1flash再review找问题

    挑毛病这块4.1flash还挺细致的

  • wilsons 09-22 14:13
    2

    这很正常吧?你无论用哪个模型,然后再用另外一个模型,都会发现很多问题。

  • fcten 09-22 14:13
    3

    Astra 自己做自己审查也一样能发现 7 个大 bug

  • findeveloping 楼主 09-22 14:13
    4

    之前暂停了$200的pro,买了$100的,感觉不够用,就试试用dsf做开发。但是比astra还是差太多了

  • tiger-big 09-22 14:13
    5

    你试下用Astra Medium做,然后用Astra Medium查,一样有bug

  • anbuzhidao 09-22 14:13
    6

    这很正常,我用Astra Xhigh写代码,4.1 flash high review也经常找出问题,拿着review结果让Astra确认,Astra也确认是问题。

  • 滴滴滴 09-22 14:14
    7

    确实是这样的,无论哪边进行审查多多少少都会存在些问题,哪怕是技术方案也一样

  • findeveloping 楼主 09-22 14:15
    8

    我还真没试过,之前每次都是用老版本gpt做,新版本出来之后用新版本审查

  • QXY 09-22 14:15
    9

    作为受害者,我要发声:千万不要贪那一点快,写出的代码级别是不一样的。一个几十行,一个上千行。我现在就是慢一点,我也满意一点。

  • slientzzz 09-22 14:16
    10

    很正常,我用gpt6写出来的东西,拿给fable5.1去审,有时候一样会指出问题,反之亦然 ^-^

  • jcc 09-22 14:16
    11

    万一gpt-6 跑到一半降智了


    可能比几个大bug更严重

  • aau436638 09-22 14:17
    12

    肯定用另一个更好吧


    这理论不用说了吧

  • 六颗冰七分糖 09-22 14:18
    13

    ^-^ 这不是很正常,你随便写个项目,同一个模型照样能一直找bug一直迭代,递归迭代

  • Kassdin 09-22 14:19
    14

    5.6sol 时代 ultra 模式刚出,就遇到过这种无限审查

    主模型->subagent写代码->subagent 审查->发现一堆问题->主模型

    然后无限循环,每一轮都能找出来两个 P0 ^-^

  • patrick 09-22 14:19
    15

    没有完美的实现,所有代码写法都是取舍

  • slhmy 09-22 14:20
    16

    Review 感觉更多是软件工程的事…


    单说模型的话我觉得像 ds flash 和 glm flash 应该和 gpt luna 比。国模最大的问题还是一直缺少一个超级模型来应对模糊场景,单论普通干活,质量感觉已经可以接受了。

  • 五河琴理 09-22 14:20
    17

    这bug肯定有的。我原来用gpt5.6做了一个网站。让opus5审核也是各种漏洞。然后让opus5修复完善。让gpt5.6审核。还是有漏洞。

  • Exdream 09-22 14:21
    18

    是个软件都有bug,看影响程度呗,影响大让ai修一下呗

  • ceva1024 09-22 14:21
    19

    问题是Astra通常在QA阶段自己就发现bug并修改了,我用dsf的感觉是最终交付给用户的版本还有很多bug

* 帖子来源Linux.do
返回