大模型也许早就进入瓶颈期了

qzzz 2026-09-13 11:12 1

连续玩降智,然后新版恢复的把戏好多个版本了吧?从4o开始就这么玩了?我严重怀疑拿最初满血的4o和现在的满血gpt-6,对普通开发者来说可能都感觉不到区别。

最新回复 (14)
  • daren2000 09-13 11:17
    1

    体感非常非常非常明显,只要使用agent,这个不可能没感觉的。而且降智是给你luna和mini,而不是4o。

    我认为今年已经达到agi了,现实世界是连续而非阶跃的,不是说有一款模型发布突然能力跃升的可怕,跑分翻了数倍还能持续学习迭代就到agi了。

    gpt6已经符合了我对弱agi的几乎所有想象,或许未来的人会把2026称之为agi元年。

  • heymeow 09-13 11:18
    2

    差距还是很大很大的,当初4o最多作为一个对话聊天工具

  • KongWenn 09-13 11:19
    3

    差距挺大的吧,能用跟好用区别不是一点

  • 还想成为88VIP 09-13 11:19
    4

    差距很大,astra的知识广度明显大于sol,无论怎么降智,知识广度带来的提升都不可忽略

  • 美帝码工 09-13 11:20
    5

    gpt 5.6 以前要 2 小时解决的问题 6 现在只需要 30 分钟性能还更好

  • 初九猫 09-13 11:21
    6

    站内还是程序员居多,这一年以来coding的提升极大程度上来自于后训练,但是coding以外能力的提升就没有coding这么显著了,很大程度上还是来自于scaling law

  • qzzz 楼主 09-13 11:25
    7

    纯算力堆上去的,新版发布,旧版流口水,说明根本就不是模型能力提升了,而是某个模型的算力池做了加减法,如果把6的算力池跟5.6对调,结果就会反过来。


    这种算力池调度的方式,openai甚至能一天发布一个版本,这么说就很直白了。

  • nullSecurity 09-13 11:33
    8

    从22年底GPT-3.5开始接触大模型,到现在的GPT-5.6,GPT-6 Astra,包括国模的DeepSeek4.1,kimi K3等等都使用开发过项目,从4o到Astra大模型的智力提升肯定是不小的,但是我认为智力提升没有最近一年的Agent的发展对日常使用的帮助大,以前只能辅助解决问题,遇到bug还得自己改,现在是真能帮忙干活了 ^-^

    或许给4o配个现在的Agent也会有惊喜

  • 项太傅 09-13 11:35
    9

    GPT-6 出来后,感觉大模型的潜力还远没有挖完。尤其是 RSI,会是一个里程碑式突破。

  • event 09-13 11:37
    10

    我怎么感觉是要进入爆发期了。astra的token效率惊为天人,别的厂商追到astra这一级,不知道会诞生多少高质量的flash。现在的AI已经开始解决千禧年数学问题了,一年前才什么水平。尤其是flash都开始逐步跟上opus4.8了,Claude5系列也才半年而已,4.8到5系列差别可太大了。

  • qzzz 楼主 09-13 11:40
    11

    gpt-3.5网页免费版,deepseek R1,grok


    完美逆向的同花顺协议下单,那时候没有agent,是直接复制IDA反编译的C语言伪代码给它们,一样完美完成任务。

  • Owen01 09-13 11:48
    12

    gpt-6 和之前的模型思路是彻底不一样的,之前的是以 chat 为底,现在是以 coding 为底,只不过需要更多算力来维持稳定可用的输出,之后肯定会有 6-luna ,terra 版本

  • 星辰此渊 09-13 13:56
    13

    不是这么算的

    你把满血5.6拿过来他也不能给你和astra一样的建模水平和审美

    code也是,lunamax和5.6sol都差距感觉的很明显

  • nono 09-13 13:57
    14

    看大模型我看评分测试也看他的大小,这个是我最关注的,了解了下数据量,模型越来越庞大了,而且是非常迅猛的

* 帖子来源Linux.do
返回