无聊瞎想,一个几乎可以预见的保守估计是,当前的顶级模型在未来会非常快且非常便宜

doraemonki 2026-07-27 11:24 1

各位可以想象一下,以后 token 像 5G 时代的流量一样消耗几乎没有限制,普通人随手可用的模型都已经比肩甚至超越 gpt5.6/fable ,随时进行工作或者创造。


并且这种智力的模型输出速度会快的吓人,每次交互你指定任务后,AI 基本都能在几秒内完成。


想想就很兴奋啊
最新回复 (47)
  • agagega 07-27 11:38
    1
    类似摩尔定律吧,所以今天做软件的时候不仅要考虑到今天的 AI ,还要考虑未来模型能到的水平
  • lel020 07-27 11:41
    2
    `像 5G 时代的流量一样消耗几乎没有限制` 那我天天省着用能等 wifi 就不用流量算什么,
  • doraemonki 楼主 07-27 11:45
    3
    @lel020 至少比 3G 的时候好多了,办个流量卡😂
  • paopjian 07-27 11:54
    4
    模型参数固定以后, 其实可以直接做成光通路或者比特币算机这种, 单一加速计算目的, 问题就是现在模型还不稳定, 总能迭代出新款, kimi k3/ ds v4 这种如果开源性能真够估计军工等地方真会愿意造的,
  • clemente 07-27 12:09
    5
    你愿意使用 5 年前的模型嘛
  • moooooooo 07-27 13:11
    6
    我也有这个判断,当前 5G 出来前谁能想到现在大街上人们能随时直播.根本没有办法想象顶尖模型像 5G 一样普及和便宜是否人们的生活状态
  • BestPix 07-27 13:13
    7
    这玩意和显卡价格绑定吧
  • dddd1919 07-27 13:40
    8
    流量依赖于基建,当基建完善下来,扩大使用的边际成本微乎其微
    模型的准确性和速度都依赖算力,准确性不变的前提下,如果满足同样的处理速度,扩大使用就要增加算力,如果再提升准确度增加参数量,算力还需要大幅扩充,边际成本递增可能都不是线性的,不涨价就不错了
  • lucays 07-27 13:48
    9
    那存储的价格还能回来吗。。。
  • seeu2ex 07-27 13:55
    10
    @dddd1919 这个才是真理,一个是投入了能复用的,另一个是完全累加性的,除非成本特别低了,不然别想了
  • gitlight 07-27 13:55
    11
    @lucays 最好的抄底时间就是现在😭
  • KagurazakaNyaa 07-27 13:58
    12
    https://www.cerebras.ai/ 你说的是类似这种方式来给模型降价吧,代价是无法迭代
    https://www.techtimes.com/articles/321152/20260721/googles-frozen-v2-chip-hardwires-gemini-architecture-tenfold-inference-efficiency.htm 或者是类似这种固化部分不变权重来获取一部分可以迭代的层
  • Razio 07-27 14:07
    13
    如果便宜的夸张,卖了这一份 token ,连维护服务器的成本都不够,那么卖给你的意义是什么?
    想象什么?想象有人为你的白吃白喝付费吗
  • changnet 07-27 14:21
    14
    你的预见 99%是错的,谁以后还在用 gpt5.6/fable 这种玩儿

    我的预见:当前的顶级模型在未来(几年内)会下线,然后消失不见。新取代的模型会更好,顶级模型依然贵
  • hdczsf 07-27 14:22
    15
    别忘了 andy gives, bill takes.大模型提升的能力,一定会被爆炸的需求淹没的.
    gpt4 当初效果很是惊艳,现在超越 gpt4 的开源模型也很多,为什么现在日常不用了呢?因为我们对大模型的要求和期待提升的更快.gpt4 已经远远无法满足了.
    未来也一样,可能一年之后,我们就无法忍受 gpt5.6/fable 级别的模型了.
  • qW7bo2FbzbC0 07-27 14:23
    16
    是的 5G 时代大批采购菊花基站,token 时代也要大批采购菊花集群
  • JShen 07-27 14:25
    17
    同意楼主的观点,后边随着模型越来越强,技术越来越突破。算力成本肯定会下来,另外就是大模型不断的开源,后边家用模型也会有进一步的进步,到时候人人模型时代肯定会来。价格也会下来。
  • Cheons 07-27 14:37
    18
    六大基建
    算力网
  • fzlqr091314 07-27 14:39
    19
    顶级智力可以购买,人类的作用又是啥了
  • terence4444 07-27 14:41
    20
    我认为现在应该是最便宜的时候,虽然以后模型会更好但价格也会更高。
  • pljhonglu 07-27 14:53
    21
    那得看多远的未来,30 年以后免费了也说不定😂
  • wqhui 07-27 15:01
    22
    @lucays 等扩产就会下来了,中国有两家生产存储,只要目前有利润,别怀疑中国企业的扩产能力。。。
  • pillowater 07-27 15:09
    23
    会不会到时候大家跟折腾 nas 一样,开始折腾家庭算力中心?
  • my101du 07-27 15:10
    24
    往后的日子里,我的手机担心我的智力的时候,就像人类看猴子一样。
  • meteora0tkvo 07-27 15:12
    25
    未来二三流模型的价格将会非常便宜,而且生成的代码质量都还算及格。而一流模型的价格依然非常贵。这点倒是有可能。
  • Vipcw95 07-27 15:14
    26
    和流量完全不一样,基站建设好了多给你一点流量少给你一点流量,成本不会变化。而模型这边就算新模型 token/耗电比优化了,那也是需要实打实拿电费跑的
  • aowugong 07-27 15:16
    27
    模型的进化永无止境,直到去到一句话命令能实现:帮我去赚 100 万
  • msg7086 07-27 15:36
    28
    640K 内存大抵也够用了,不够用的话再用上扩展内存,4MB 什么事干不了啊。很难想象人类需要多达 2GB 的硬盘空间。IP 地址支持 200 万个网络数了,再怎么说全世界能联网的设备也不会超过 200 万台了吧。
  • AEDaydreamer 07-27 15:55
    29
    我希望的是基础模型能力到一个瓶颈以后先锁个版本, 保持智商稳定, 价格合理, 能够真的成为基础设施.
    现在这种几个月一迭代的循环是很兴奋, 但是真工作起来又用不爽,个人也没法部署足够参数的本地模型.
    但是反着说一旦这种叙事循环被打破, 市场也是要爆炸一波.
  • Meteora626 07-27 16:01
    30
    当模型上限卷不动的时候才会卷价格,当模型固定了,才会有专门的推理芯片来适配,gpu 来推理还是太贵了
  • laikicka 07-27 16:07
    31
    @wqhui 长鑫部分 DDR5 服务器内存报价甚至高于三星同类产品..
  • yongzhenchen682 07-27 16:13
    32
    倾向于更小的垂直类的模型,本地模式,人人可以部署。大而全 2 级分化
  • ddonano 07-27 16:19
    33
    肯定会便宜的,参考通讯行业的发展,目前感觉我们还处于“大哥大”时代,ai 基建又是一个可以参考通信行业的新兴行业
  • HeyWeGo 07-27 16:32
    34
    从原人类角度触发,确实需求不止,但是如果只是针对个人来看,大模型能力实际上并不需要多强。
  • lucays 07-27 17:19
    35
    @wqhui 我很怀疑。因为这俩家目前报价并不比三星啥的低。而且他们做的还不一样不是竞争关系,本质无竞争对手。
    我们的扩产内卷都是建立在我们自己有竞争对手的前提上的,光伏啥的都是这样。

    但是没有竞争对手的时候,内卷扩产?目前是没看到。
  • nc 07-27 17:34
    36
    AI 和互联网是两个行业,AI 边际成本很高,除非有颠覆性的技术突破,否则 token 绝对不会接近现在商用带宽的成本。
  • zictos 07-27 17:41
    37
    chatgpt 现在付费版降智后或者免费版应该是不如 2023 年的时候的 plus 的吧?
  • chengYT 07-27 17:43
    38
    英伟达卡卖的太贵了
  • 27149 07-27 17:45
    39
    法拉利在每个时代都很强,但价格一直在顶尖,并没有因为技术的发展而便宜。
  • enpitsulin 07-27 18:17
    40
    你这个判断的前提是,模型的能力会无限增长,但是谁敢肯定呢?最近的模型发布,大家都能看出来其实没有超过前代未降智版本多少,已经开始挤牙膏了
  • nightlight9 07-27 18:53
    41
    5 年后,可以预见的是算力硬件会有大的降价+性能提升

    所以一定会有很便宜的模型供大家使用
  • billlee 07-27 19:40
    42
    5G 时代的流量明明就比 4G 时代涨价了
  • Dxxxxs 07-27 20:48
    43
    假设未来,Scaling Law 基本失效了,大家公认基座模型已经做到头了,再堆数据、堆参数、堆算力收益都很小。那 AI 行业的重心是不是会从训练完全转向推理?
    这样的话,感觉可以像 CPU 一样开始长期围绕固定架构做优化。
    比如 AI 专用 ASIC 、存内计算、光计算、更激进的量化、MoE 专用芯片等等,把推理成本不断压低。
  • ddddd0 07-27 22:39
    44
    按照过去两三年的趋势,确实是这样,现在的顶级模型的 token 价格和以前比起来是非常非常便宜了

    这个趋势下去的话,3 年后对普通人来说,全行业专家级别的人工智能费用都是会非常低,一天 1 块钱就根本用不完了,再往后 比如 2030 年 可能就约等于免费
  • chenluo0429 07-28 00:01
    45
    我认为没有革新,模型已经几乎到顶了。在一段时间后,所有模型厂商都能训练出能力齐平现在的 SOTA 的模型。最近一两年的进步,几乎都是 agent 带来的。
    另外大模型目前高昂的成本,根本无法和互联网早期相比,毕竟那个时候起步很低,发展空间很大。
    类比一下就是三十年前,我家门前的土路开车只能时速二三十码,现在走高速可以到 120 码,三十年后时速能到 500 码吗?
  • GyroZeppeli13 07-28 00:04
    46
    便宜是肯定的,但是极端的廉价应该很难。

    目前美国的电力成本在算力中心中占的比例是 10%,未来大模型假设电力成本占到了大头,成本价格也就打下去五倍,如果电力成本还能再优化一下,也就是比现在便宜十倍,二十倍这样。
  • SimonOne 07-28 02:05
    47
    我觉得会保持旧模型下架新模型上架,不可能给你便宜大碗的。
    如果做成细水长流的形式,只会是行业发展到瓶颈了,但是现在炒模型的公司一到瓶颈还能活下来几家呢,要便宜大碗肯定得死得剩几家,这恰恰是俺们中国的行业发展形式,那活下来的这几家除非是国家政策扶持(比如老美出个法案禁止老美企业使用中国模型)否则一定是中国的成本卷得便宜。
* 帖子来源V2EX
返回