模型真的不够用吗?还是你的用法有问题?

雾满眠 2026-08-15 09:25 1

经常看到有人说模型 降智 ,测试不合格。


但以当前模型的能力,拿DeepSeek为例,日常代码开发已经完全够用了。


从代码层面来看,本身的架构设计不合理,导致模型思维混乱

还有一个是prompt范围给太大,帮我实现一个xx功能。。

限制模型无休止地自我对抗、钻牛角尖、想象等行为。


除非对代码完全不懂的,但凡对自己的代码了解的,ds以上的模型都是够用的

最新回复 (17)
  • 白夜 08-15 09:26
    1

    但,问题是不懂代码的人在deepseek的用户里可能占比95%以上,比如我 ^-^

  • TXDXIP 08-15 09:29
    2

    不搞许愿式开发现在主流模型能力应该都是够的吧,最近vibe coding,描述的要精确,给出实现路径,讲好要做一个什么样的效果,就实现的还行。要是提示词太过模糊,ai就开始乱写了,还会把之前写好的改坏

  • 雾满眠 楼主 08-15 09:30
    3

    ^-^ 其实做做一些小工具啥的应该都是没问题的。想完完全全vibe coding 一个大型项目还是比较困难的。

  • admini 08-15 09:35
    4

    排除专业领域(数据闭源没训练到,算法未公开)。当然还有 Vibe coding 领域。

  • 白夜 08-15 09:36
    5

    正好借楼询问,我正在用4F逆向一个APK,但我不懂代码,我感觉是它一直在撞墙,而且也完全不懂它进行的如何了,我感觉这样跑好像逆向不了这个apk。这是一部分内容,佬能帮我看下不

  • Enze 08-15 09:39
    6

    1. 勉强够用,好用还远谈不上,而且模型能力不稳定,自己部署又太贵

    2. “降智”这种模型性能变化是真实存在的,有 anthropic 文章和相关论文证明,变化后原本够用的模型也不够用了,你这个“但”字我没看懂

    3. 目前 vibe coding 里人类会严重拖慢 AI 的效率,如果只是追求人对 AI 写的所有代码都有足够的掌控力,那一些老模型其实也够用,但这 AI 也没什么出息了,因为我坚信大部分人都是和我一样的水货(架构能力一般、代码丑陋、知识面又窄又浅)

  • NukaColaM 08-15 09:40
    7

    我认为两种说法都有道理的。

    当前模型哪怕是fable,实际生存中的各类复杂工程都是没办法one-shot的,人都是懒的。

    但说能力足够也够了,只要拆分得当,复杂工程也依然可以慢慢组合成型。

  • 小新阳 08-15 09:41
    8

    我没有精力去和ai把一个复杂的内容通过一次次的对话讲清楚,我宁愿自费购买更贵的套餐和模型让他自己去探索现状解决问题,也不是把我宝贵且有限的精力用在这个上面

  • undefined 08-15 09:42
    9

    ^-^ 谁教你这么玩的呀?

    你前面输入那么大一坨是为了指导LLM呢还是误导呢?


    不都是先分析行为,然后再找具体的点么。。

  • 白夜 08-15 09:42
    10

    实际上这已经是跑了3个多小时了,然后我叫他自己总结,把总结发给sol,让sol帮我制定一个提示词,就是这样

  • 雾满眠 楼主 08-15 09:43
    11

    不在知识范围内了,这种是丢给他自己慢慢玩了,比如像claudecode可以 byway询问进度。但是一直自我搏弈那种会及时止损,或者总结一下新开一个会话继续讨论。

  • 白夜 08-15 09:44
    12

    我就是这么做的,感觉不太对了,就让他自己总结了一下,又让SOl矫正了一下,结果SOl给的提示词好像太长了

  • 时牧 08-15 09:51
    13

    很多人没有 Fable等级的模型就没法工作,不过这类人被替换的成本也更低

    既然没有什么人工介入的环节,那换谁来都一样

  • 雾满眠 楼主 08-15 09:54
    14

    目前没有人类把控,任何AI是无法完成大型需求的。


    简单的例子,一份PRD过来,AI的上下文是远没有人类充足的。


    人的引导 在现阶段挺重要的

  • wilsons 08-15 10:04
    15

    是的,哪怕你写的很详细,它总会出现人和AI之间理解的偏差,哪怕一点点偏差,累积起来,它就会出现很多bug。如果没有人类干预,AI是无法知道这些真实的bug的。然后随着功能的不断累积,这些bug将使这个项目彻底崩溃,无法使用。

  • 23q3 08-15 10:07
    16

    说起来当年用sonnet3.5也是照样vibe,但是模型越好vibe起来越省心啊,是真的爽,回不去了,现在不用顶级模型都感觉膈应

  • wilsons 08-15 10:14
    17

    我之前还用过千问 2.X 的。那时候有时候碰到 AI 解决不了的,还得自己手动调试。现在几乎不需要自己调试。但有时候,还是需要给他方向、引导,给出更合理方案。期望下一代模型,这些都不需要了。

* 帖子来源Linux.do
返回