昨天跑3000万nvidia免费token

royswift 2026-09-11 03:43 1

昨天用的nvidia的免费模型deepseek-v4-pro-0813和kimi-k3,修改了一天一个中小项目代码,断断续续大概跑了10个小时左右吧。

跑了老黄nvidia大概3000万的token。慢是真的慢,但还算稳定,偶尔524报错是因为套了cf导致的。



我保守的设置的并发2,rpm大概6~10,实际还可以更快些,用的紧凑点一天跑超过5000万token完全没问题。

最新回复 (2)
  • jb 09-11 03:49
    1

    5000万输入和5000输出可不是一回事 ^-^

  • royswift 楼主 09-11 10:15
    2

    @jb #1

    我特意问过ai,是能差几倍。


    按 API 按量计费 估算:
    跑满 5000 万 tokens,
    ChatGPT 当前主力大约 几百到两千多美元,DeepSeek 当前主力大约 十几到几十美元。
    具体金额高度取决于 input/output 比例、是否命中 cache、是否高峰时段。

    我只是觉得老黄家的这免费模型,也能凑合用的。

    老黄家的deepseek-v4-pro-0813和kimi-k3好像并没有明显缩水。

    ai给的评价,老黄家k3开到最大 大概相当于opus-4.8-max或者gpt-5.5-xhigh,老黄ds-v4-pro大概比k3稍微低半档,按照这性能,写中小型项目感觉够用啦。


    再算价格,这5000万token最便宜也要几十块钱,这是一天的用量啊。


    我不是专业程序员,也只有手头这个自己用的python下载小程序来跑代码,而且统计的这些数据也是纸上谈兵,但是感觉免费模型用着还行哦

* 帖子来源NodeSeek
返回