经常看到有人说某国产模型有多强大,甚至敢碰瓷GPT5.5,有没有大佬全都用过的?

爱折腾的sky 2026-06-07 00:59 1

有没有大佬实际vibe coding过生产级项目,并且这些模型都用过的?国内哪些模型真有那么强吗?


发这个帖子不是踩谁捧谁,只是目前我用codex的GPT5.5很满意,质量很符合我的预期,但是有点想转国内模型了,想求大家给点真实评价和建议,非常感谢

最新回复 (19)
  • 洛卡卡了 06-07 01:00
    1

    个人国模使用体验下来 glm 和ds还是可以的。minimax最拉。 其他的就不知道了。。。

  • 娜娜米 06-07 01:00
    2

    性能方面肯定都还有差距,目前的比肩更多是跑分,实际不如国外大模型,除了 API 性价比是拉满了

  • 爱折腾的sky 楼主 06-07 01:01
    3

    glm 和ds 对比codex的GPT5.5的差距有多少呀?大佬

  • 洛卡卡了 06-07 01:02
    4

    我仅代表个人的看法,在我使用下来 写代码返工次数方面 gpt5.5一次的话。glm需要三次 ds写代码少 其他方面还不错。 minimax直接给我家偷了 我恨一辈子…

  • yxbj 06-07 01:03
    5

    我只能说大约等于5.2吧,差距在3-6个月之间,claude 大概是4.6 sonnect的水平

  • 柯隆布蕾酱 06-07 01:05
    6

    目前体感来说,ds4.0pro 使用在moviepilot的agent里,完全没有不适,甚至能盖过gpt5.5一头,个人观感来说感觉ds针对agent有过特化训练。他能完全按照agent里的skills及其他人格啥的完美运行。gpt5.5有时候会抽越过skills进行操作

  • dotaevo 06-07 01:08
    7

    我自己的感受是:如果不怕折腾,其实国模是可以替代gpt的,但是国模的准确率确实比gpt低一些。项目简单或者需求简单时基本可以平替,有时候甚至国模还能更优秀,但稍微复杂一些的时候国模就容易出错,但gpt往往会稳定很多。就我自己的体感而言,某个需求如果国模实现不了,其实换gpt也大概率实现不了。gpt能实现的,其实很多国模大概率也能实现,但区别是gpt可能就几轮对话解决,国模蠢的时候要跟它对线几十轮。

  • 爱折腾的sky 楼主 06-07 01:09
    8

    说的我对ds4.0pro有点心动了,但是我没用过moviepilot的agent,直接接trae的话,效果也很好吗?

  • DragonSoul_CN 06-07 01:10
    9

    我个人体感来说 Deepseek V4 pro 和 gpt5.5 但从编码来说没有什么区别。缺点就是没有多模态

  • 沉海墨 06-07 01:12
    10

    在拥有明确和清楚的开发需求的情况下,国内部分厂家的旗舰模型可以实现更快速的开发过程,但是,如果本身描述比较模糊,GPT可能会更加合适,即“稳稳地接住你”,模型本身的本底智能会很大程度上影响开发体验。

  • 爱折腾的sky 楼主 06-07 01:13
    11

    谢谢大佬的建议,Deepseek V4我用网页版,感觉跟gpt5.5差距确实不大,但是完整的开发项目的话还没试过,用Deepseek V4 pro的话,想发挥他的最大能力的话,agent应该也很重要的吧?接trae的效果如何?大佬你是对接的哪个agent?

  • javafun 06-07 01:16
    12

    如果是纯vibe,对代码不熟悉的,那就gpt一步到位,别折腾了

    如果是对自己负责的项目很熟悉,手活还在并且能一眼看出AI错误,平时需求也不是那种涉及多个联动模块改动的,可以用国模代替

    工作生产级还是推荐gpt,返工一次等于灾难

  • DragonSoul_CN 06-07 01:16
    13

    我hermes agent对接的 deepseekV4Flash好用的很,现在做计划决策方案用pro,码代码和自动化任务跑测试flash足够,有点是真便宜。

  • SSN007 06-07 01:18
    14

    跑分可以作弊的,之前就看到过一个视频,指出opus在执行benchmark的时候会自己写测试用例来验证自己的结果,尽管提示词里明确说明了不要进行自测 ^-^

  • Aelura 06-07 01:19
    15

    互联网上的特别是短视频平台不建议轻易相信,他们只要流量,真实性不会怎么核查的,甚至没有相应方面的基础

    前几天还刷到个视频说minimax已经可以比肩claude4.7opus了 ^-^

  • SSN007 06-07 01:21
    16

    这个确实,但是那个视频是国外一个知名实验室发的,具体结果是怎么样的见仁见智吧,不过对于跑分这种基准测试,目前来说确实没有权威的验证机制。最终还得是以实际体验为准

  • maoge 06-07 01:21
    17

    和以前相比进步很大,

    完成一般的项目也行了,

    免费用就可以呀。

  • LupoGame 06-07 01:22
    18

    体感上百分之15到百分之20左右的差距吧 可惜国模价格完全没有可比性

  • Rowenl 06-07 01:29
    19

    目前我国内外的都深入用过,现在一直在用 claude,国内最早用过 glm 和 minimax,按我自己的使用感受,glm 会强一些,minimax 在 code 方面还是弱了一些,当然它的主要方向也不是 code。最近几个月 ds 发布了新版本并且价格很划算,我觉得在抢不到 glm coding plan 的情况下,用 ds 的 api 也是一个不错的选择

* 帖子来源Linux.do
返回