求量大便宜的token

Misakall2 2026-06-20 17:14 1

佬们,有没有量大便宜的coding plan 或者是其他的。不追求模型质量,最近一直在用deepseek v4 flash,想看看有没有其他的便宜的量大管饱

最新回复 (19)
  • 甘棠 06-20 17:15
    1

    不追求模型质量



    用来干啥,不追求模型质量,3B小模型可以吗?

  • HeriX 06-20 17:18
    2

    opencode go里面的v4flash, 比直接官网调用便宜

  • darkstarrd 06-20 17:19
    3

    sensenova,5小时1500次ds4f调用,一个手机号注册一个号,多注册点就可以有很多可用了

    ```www.sensenova.cn```

  • Misakall2 楼主 06-20 17:19
    4

    我现在是用来每天跑脚本简单的对话 ^-^

  • BreakFeeling 06-20 17:20
    5

    试试本地跑一些小的模型呢,如果只是一些非常简单的任务

  • Autsun 06-20 17:20
    6

    绝版的40的腾讯的codingplan,基本上很难用完,有GLM-5和Kimi-K2.5,就是只能续费,买不了新的了,opencodego新用户的5刀套餐,60刀额度你只用v4flash也是基本上用不完

  • Misakall2 楼主 06-20 17:22
    7

    我现在在看火山方舟的50coding plan ,不知道只跑豆包够不够用

  • WuLi 06-20 17:23
    8

    买个硬件直接本地跑模型可能更加便宜

  • sayurinana 06-20 17:23
    9

    OpenCode Go,35人民币,月限额60刀,约等于420人民币,然后现在它家是限时对于minimax m3 3倍额度,相当于1260元额度(实际可能有波动约在1200~1400也可能的),然后对于一个正常的agent使用场景,你的上下文长期主要处于100k~400k且使用的agent是正常的主流不是什么路边,能有正常的缓存命令,平均来说m3能达到1元2.5M Tokens(综合用量,涵盖输入输出缓存)的用量,共计2500M Tokens,也就是,实质性花费在35元能用25亿tokens

  • Autsun 06-20 17:23
    10

    火山的我没买过,但是买过的都说用量很少

  • sayurinana 06-20 17:24
    11

    而且这个模型它支持多模态,如果你是用来跑非重度coding且质量要求高的,只是跑一些综合任务,主要需求是用量大且不想模型太蠢,那么这个opencode的minimax m3正好适合

  • Misakall2 楼主 06-20 17:27
    12

    看其他佬分享的都是用的glm或者是其他的模型用量小,我就像看豆包这个模型用量应该会大一些

  • Misakall2 楼主 06-20 17:27
    13

    (帖子已被作者删除)

  • sayurinana 06-20 17:28
    14

    火山现在套餐限时四分之一费用,同时针对GLM-5.2限时四分之一抵扣系数,也就是说,火山的GLM 5.2现在是相当于十六分之一花费,原价200元现价49.9的medium套餐,全部拿来用GLM 5.2模型的话,总月限额约为6亿Tokens(前天算的,具体的不记得了,同样是指正常场景的综合使用数据,涵盖输入输出缓存),而且GLM 5.2,我自己用的感觉是,,,确实很难区分它和Claude Opus,除了它不支持多模态,其他没毛病,聪明能干(本来是很贵的,但是现在火山的不贵了)

  • Misakall2 楼主 06-20 17:28
    15

    感谢佬,感觉这个方案可以试试,我一般也不用来coding,只是跑脚本对话

  • Autsun 06-20 17:28
    16

    可能吧,如果只用豆包用量应该会大一点,火山的codingplan,豆包好像没有倍率,听说是这样,其他模型有倍率

  • lancerys 06-20 17:29
    17

    没有吧?商汤这个5个小时DeepSeek只有500次。

  • sayurinana 06-20 17:30
    18

    这个

    Agent/Coding Plan 指定模型抵扣系数限时折扣活动–火山方舟-火山引擎

  • Autsun 06-20 17:30
    19

    佬们,我现同时有智谱和方舟的 CodingPlan,都放在 sub2api 和 new-api 里自用以避开智谱高峰期,现在有一个问题,智谱的 GLM 是可以识别图像的,但是方舟的不行,于是会出现
    API Error: 400 Model only support text input
    问题,求教佬们如何让方舟的图像识别自动路由到例如 MiniMax m3 上,有没有这种操作或方式?


    多模态的话你可以看看这篇帖子我的回复,自己写个skill,让GLM通过调用其他模型具备多模态能力,就免得每次要自己去切

* 帖子来源Linux.do
返回