普通程序员,大模型之争如同 Jdk 版本

cloudzhou 2026-09-22 16:58 1

之前一直使用 opus ,然后 gpt
困惑于各种封号和中转,决定直接 deepseek flash 试试
非常惊讶,我甚至区分不出差异,尤其你任务拆分的够细的话,实现差距极小

让我不由得想起以前远古时代,“你们用 jdk 几?”
实际上,好的代码,核心并非在 jdk 几点几版本,同理现在差距不大的大模型,用于普通业务差距很小
最新回复 (30)
  • jackOff 09-22 17:05
    1
    deepseek v4 flash 在不同 agent 和不同程序员手里表现差异非常巨大
  • cloudzhou 楼主 09-22 17:09
    2
    @jackOff 我想表达的就是要善用工具,而不是一味的以为用上最好 ai 就怎么样
  • marsg 09-22 17:32
    3
    然而程序员都快没了。
  • newaccount 09-22 17:33
    4
    一个需求做不出来,是模型的问题还是人的问题
    你让他怎么选?
  • Sezxy 09-22 17:36
    5
    v4.1flash 日常开发速度很快,质量也能接受。小任务我都懒得用 gpt5.6-sol
  • YanSeven 09-22 17:43
    6
    当前大模型从研发团队到用户群体,看中和攀比的应该都是其“许愿能力”吧。
  • longaiwp 09-22 17:54
    7
    我一直都在用开发生产代码上,只要不是发散思维的问题,处理得很好。
  • gibber 09-22 18:01
    8
    @jackOff dsv4f 用哪个 agent 比较好呢?
  • agentd 09-22 18:03
    9
    @marsg 心酸
  • cloudzhou 楼主 09-22 18:14
    10
    @marsg 这是另一篇忧伤的帖子了,大约就这两年了
  • foryou2023 09-22 18:18
    11
    一直使用 deepseek v4 使用的挺好的,自己 在 pi agent 里面写的 plan 插件。流程一直都是先把需求讨论清楚,然后让 ai 写成文档,然后再让 ai 干活,一直挺好的。
  • cloudzhou 楼主 09-22 18:37
    12
    @Sezxy 对,对比一下 v4.1flash 快的飞起,gpt 一跑我就想摸鱼,好几分钟
  • chjqpmain 09-22 20:34
    13
    确实是,我有段时间不问了(绝对不是因为我大部分时候都用最新的 gpt 和 claude),
    不过我也想到了之前看到的一个梗:
    23 年程序员惊叹于 ai 的智力,把代码复制下来修改
    26 年程序员愤怒于 ai 的降智,换更好的模型处理问题
  • z1s23 09-22 22:05
    14
    @cloudzhou 我选 GPT ,因为它可以让我有摸鱼时间,DeepSeek 太快了,我甚至看不清它吐字的速度,不利于摸鱼
  • jackOff 09-22 22:06
    15
    @gibber 很诡异的来说,这玩意在 zcode 或者 claude code 表现似乎比较强,但是这俩客户端嘛。。。。。。目前我是用 deepseek harness,一个是安全,另一个是节省开支
  • webcape233 09-22 22:14
    16
    vsc 的 copilot 接入的,感觉还行啊,我也搞不懂重置党天天开发的啥?难道是我说得详细,反复推敲方案,几个 ai 都审核后,再用最快的 gemini 一把梭。我还会不时更新文档和.agents ,rhai 优化项目级 skills 和 rule ,经常 refactor 。是不是用高端模型的直接喊话就行了
  • bbbblue 09-22 22:31
    17
    只要你不是许愿式编程 特别那种给一个任务 然后去睡觉了
    而是你本身懂模型在做什么 会打断会指导 那其实用起来差没太多
    之前 gpt 又卡又降职 从 5.6sol 换到 grok 4.6 和 ds 4.1 flash 已经用了俩礼拜了 也是同感
  • gibber 09-22 22:37
    18
    @jackOff 我用的 claude code cli 不是很爽,现在连自动模式也用不了了
  • Tianqi 09-22 23:05
    19
    deepseek v4.1 flash 这么好用么,我感觉真的抽象,沟通不了一点
  • 1874w 09-22 23:12
    20
    太真实了,现在天天都有人发各种模型降智水帖,说到底还是自己的流程不对,或者说一直都是许愿式开发,只要发现和之前预期不一样,或者稍微说点胡话,就开始发帖吐槽。但实际情况是,会用的人不会发帖夸他完成的好,能看到的帖子全是降智帖。
    降智可能确实会影响一些,就像 JDK 版本,新版 SDK 在某些场景可能会有更好的体验,但确实很少很少一部分。正常的开发流程熟悉和掌握之后,这些偏差很容易就修正了。对于完成工作来说,没有任何实质影响。
  • 1874w 09-22 23:19
    21
    @newaccount 人总是自我趋向于自我解释和修正。需求完成不了 => 怀疑自己 => 看到社区说模型不行/降智 => 怀疑模型。反正不能是自己的问题。
  • jim9606 09-23 02:44
    22
    需要留守 JDK8 的都是,我不知道它咋跑的,反正他就能跑,所以就不动,虽然升了好像没啥问题,但我不想背锅。
    这事如果换成 LLM 就是,你的工件需要 LLM 的响应可重现才能跑起来。
    可能是 LLM 还不够资历养出这种奇葩工件出来吧?
  • maolon 09-23 05:19
    23
    我觉得还是有区别的,特别是模型降智这种场景,最可怕的地方是当你发现他降智的时候他已经在代码库里拉了一坨了,而且可能是前一个请求好的后一个请求就坏了,这不是什么“流程改善”能避免的问题

    而且之所以争这个就是因为每个模型他实现的速度,质量,价格,稳定性都不同,比如 luna 他可能非常便宜质量尚可,但是非常慢,比如 deepseek 他质量尚可而且快,但是需要指导(人长期驻守)而且越来越贵,比如 gpt 系列就不擅长前端,这些都是模型特性上的明显差距也是跑分看不出来的东西,而且每代模型都不同。

    当然你说我就这个用途,在我的用途下区别不大那确实没问题,但是我认为对大部分人来说还是有区别的。
  • iorilu 09-23 07:52
    24
    我反正全面切换到 dsf4.1 了

    速度质量都能接受, 关键是便宜, 不考虑 token 用量

    我实在最近火的 dsh desktop 里面用的, 还没仔细研究, 但这个工具确实能发挥 dsf 模型能力, 潜力非常大, 可以随便套插件
  • kneo 09-23 07:52
    25
    感觉不到区别说明你还是没有善用工具。
  • TirionHo 09-23 08:52
    26
    我都用 AI vibe coding 了,肯定是想体验许愿式开发啊,直接一个大任务开 plan 模式跑多爽
    自己将任务拆分得很细让智力差的 AI 辅助开发,就比 cursor 代码补全高级一点点
  • fredweili 09-23 09:03
    27
    简单任务也许用不出来,我也没那么 pro
  • ajaxfunction 09-23 09:10
    28
    有没有可能是你的需求太简单了,简单到降智后的模型也能胜任你的任务
  • cloudzhou 楼主 09-23 09:34
    29
    @kneo 不,区别不大才说明善用工具。这一点来说我有点像所谓的*第一性原理*,工具重要性并不大
    @TirionHo 我昨天试了一个之前跑过的 plan ,比 gpt 给的技术文档,更符合我的期待,可能是我描述更清晰了
    @ajaxfunction 以我对互联网需求业务复杂度的了解,80% 业务大模型差距就是不大

    再总结一下吧,就像选 mysql / postgresql 一样,在绝大多数互联网开发,都是没有差异的,都能满足需求
    而反而要求你把 sql 写好
  • cloudzhou 楼主 09-23 09:38
    30
    @TirionHo 我认为大一点的开发,无论哪个模型,plan 模式都需要的,还有就是测试用例,这种循环反馈才是完成一个大需求的保证
* 帖子来源V2EX
返回