面对越来越贵的 token 我们能做什么

zhangli2946 2026-09-07 15:40 1

今早 kimi 申请退款了。


换了 scnet.cn 的按量调用。


我体验下来,模块级别代码补全、vibe coding 、人类强_监督的编程工作中,Deepseek-V4-Flash 已经很够用了。


突然"涌现"了一个想法,缓存命中是复用,"标准构建块" 复用怎么就不是复用了?


贵价模型,输出_消尓壳_代码,不是"殄暴尤物"了。

最新回复 (34)
  • jhytxy 09-07 15:41
    1
    gemma4 qat 版本已经够用了

    两张 2080ti 22g 的事
  • zhangli2946 楼主 09-07 15:43
    2
    @jhytxy 我 4060ti G(8) ~有用~
  • coefu 09-07 15:44
    3
    如果厂商为了性能更好,都搞隐式推理,显式的 token 生成就会大大降低量。不过订阅就要从纯 token 模式,换花样了,毕竟在他们模型里多跑几趟,那也是耗算力更多。

    只要还用厂商 api ,那么就是砧板上鱼肉。
  • foryou2023 09-07 15:50
    4
    看了一下这个这么贵
  • foryou2023 09-07 15:51
    5
    @foryou2023 这比官方也贵太多了吧。

    DeepSeek-V4-Flash-0731
    [暂不支持闲忙时定价] [RPM 预设为 200] 2026 年 7 月 31 日发布的高效轻量化 MoE 模型,总参 284B ,激活 13B ,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG 、批量文案处理等普惠刚需场景。

    模型价格
    计费项 单价
    输入 3 元 /百万 tokens
    缓存命中输入 0.3 元 /百万 tokens
    输出 9 元 /百万 tokens
  • YanSeven 09-07 15:53
    6
    跟随市场而动即可,无所谓,大不了不用。
  • zhangli2946 楼主 09-07 15:58
    7
    @foryou2023 啊? 更贵了?
  • zimue 09-07 16:04
    8
    我开发一个,可以直接免费使用各平台 AI 的插件,而且解决的就是 TOKEN 太贵的问题,欢迎试试了。这是插件下载地址: https://github.com/07/dda/blob/main/duoda-ai-chrome.zip 。刚更新了官方:www.duodaai.com 。
  • msg7086 09-07 16:25
    9
    按量用不起,我还是订阅吧。
  • TArysiyehua 09-07 20:18
    10
    @zimue 哥们,你这玩意跟太贵没啥关系,说实话多个对比也解决不了问题,如果你能把各大厂商的这些免费额度提取出来给 codex ,cc 用,这才是真的省 token
  • wolfie 09-07 21:40
    11
    是越来越便宜吧?
  • Tiande 09-07 21:54
    12
    是越来越便宜吧?
  • SilencerL 09-07 22:10
    13
    美团客服可以当编码助手用
    甚至 https://github.com/kltyton/fanzha-ai-proxy 也可以当编码助手用
  • luckyjoe 09-07 22:17
    14
    按照智能来约斤算,token 应该是便宜了。
  • ktyang 09-07 22:19
    15
    scnet.cn 是我用过的最贵的订阅,只能是当给国家交税了。。。
  • iBaoger 09-07 23:36
    16
    Token 是新时代的流量,你把它当成手机流量看待,心里就平衡了,现在还有各种免费活动,后面很有可能都要付费的
  • XnEnokq9vkvVq4 09-08 00:35
    17
    越来越贵在哪?
    o1 pro 输入输出 $150/$600
    GPT-4.5 输入/输出 $75/$150
    o1 输入/输出 $15/$60
  • CityFork 09-08 01:19
    18
    做不了什么,而且悲观地看,未来更聪明的智能,会更贵
    现在已经是投资人补贴花钱买用户数据的周期(对于除 ds 外的大部分模型厂商来说),如果未来 infra/硬件没法大规模降价的话,那么现在应该已经是 sota 模型的廉价的巅峰
  • chjqpmain 09-08 04:18
    19
    我个人的打算是,
    用跑通的盈利模型在如今相对划算时,利用大模型不断降本增效,同时扩大规模,积累足够的本金,声望,经验,履历..
    同时不断提升自己的技术,知识,争取未来能基础足够到参与前沿的活动
    最好是准备做事,做人两手抓,
    每时每刻都在不断博弈,谁掌握权力,谁拥有财富,谁才配拥有尊严, 虽然我也很想有了三就够了,但可能前两个和最后一个本就是一体两面的
  • mechunjun 09-08 04:19
    20
    并不贵
  • maolon 09-08 04:34
    21
    并不贵,不如说如果按同智能算还便宜不知多少了,去年的旗舰模型的编程能力今年一个 27b 的模型就能复刻,而 27b 的模型在各大 provider 这里基本都是 free 这一档的

    而且尖端智能的价格前面也有人回过了,o1 和 4.5 的价格还摆在那呢
  • Hubs 09-08 04:51
    22
    试试我的开源项目,每天嫖个 2~3000w token 还是没问题的。
    https://github.com/huzhensx/API-N1-Router
    https://i.imgs.ovh/2026/09/08/31d689bfe0d5d95397afde291c00b983.png
  • zerovoid 09-08 05:34
    23
    没事,至少现在还需要人类来指挥 AI 敲代码,
    再过几年不再需要人类指挥 AI 敲代码的时候,
    也就无所谓 token 贵不贵了。
  • passive 09-08 05:49
    24
    生命宝贵,时间宝贵; token 不贵,我喝咖啡时每分钟的消费都比 token 贵。不能把生命浪费在比咖啡还便宜的 token 就能完成的任务上。
  • canyue7897 09-08 07:59
    25
    @passive 问题是咖啡一天就够了。一天的 token 费用一杯咖啡可不够。如果多个任务同时跑,那绝对天价。
  • WessonC 09-08 08:14
    26
    @canyue7897 那难道不是因为你任务的性价比太低嘛 :)
  • dhx920 09-08 08:22
    27
    @foryou2023 deepseek 这个价格也太贵了吧,你看看我之前的帖子,参考 deepseek 那个价格
  • meteor957 09-08 08:25
    28
    什么都不想做,他贵任他贵,不想玩了。
  • ayamatsuura 09-08 08:31
    29
    哈哈哈,一直白嫖 gemini
  • Gomoku2024 09-08 08:36
    30
    @ktyang 这个可不是国家队的。。。
  • junas7 09-08 09:08
    31
    我有一个不消耗 token 的模型调用方式,但是大家都管它叫古法
  • jamel 09-08 09:23
    32
    @zimue 牛逼,感谢,可以提供 api 吗。我在找一个可以调用 使用免费网页 ai 版 的 程序,每天蹭一蹭 各个厂商的额度,来完成 coding
  • dingwen07 09-08 09:42
    33
    国模确实越来越贵,性能也……
  • zimue 09-08 10:40
    34
    @jamel 不用 api 的,就登录自己各个 ai 平台就行。我在自己的帖子下,每天有送码的。https://v2ex.com/t/1239749#reply8
* 帖子来源V2EX
返回