(慎买!)已下单OllamaPro,分享DSV4F体验,以及计算出的额度,还有雷点!!!

iJoker 2026-08-20 00:20 1

最大的雷点:


最长输出只有 65k tokens!


这会导致什么问题?


面对复杂问题时,DeepSeek-V4-Flash 开启 Max 思考后,会开始长时间推理,但还没思考完就撞上输出上限。结果就是:复杂问题基本无法在 Max 思考模式下完整解决。


主观体验



  • 速度非常快,真的快,输出速度像“拉稀”一样停不下来。

  • 智力水平暂时不好评价。

  • 我准备的一道难题,它目前完全没思考出来。

  • 目前整体体感一般,小任务表现中规中矩。


参数参考



大家最关心的额度


一下午大约消耗 132M tokens,占每周额度的 10%。我还让 Grok 反推了一下:



额外优势


Ollama 还有一个优点:不用担心缓存命中问题。


假设按照这些 tokens 计算,并且有 95% 的命中率,再对齐 Command Code 的定价规则,结果如下:


最新回复 (9)
  • arui 08-20 00:24
    1





    刚好我也有

  • Pig 08-20 00:25
    2

    有glm5.3吗佬,这个用量其实还可以

  • iJoker 楼主 08-20 00:25
    3

    大任务直接推理不出来,太失望了我敲!!!

  • soul0932 08-20 00:27
    4

    佬记得更新啊,很想看看更具体的数据

  • arui 08-20 00:27
    5

    他的计价很迷,我全用的deepseek v4 flash

  • iJoker 楼主 08-20 00:28
    6

    还想知道啥,我回头都测测看看,目前是有点失望的

  • soul0932 08-20 00:32
    7

    想看看这个量是不是有误差,之前有一位站友测出来月额度是70来亿.

    commandcode套餐ds flash是6倍额度.

    再考虑到速度稳定性,感觉ollama用flash已经是最好的选择了.

  • iJoker 楼主 08-20 00:35
    8

    用量仅供参考,ollama计费本来就很迷,即使是五十多亿,对比下也是非常多了。

    只看额度的前提下

  • alextttttt 08-20 01:45
    9

    感谢佬的测试,我也准备买,但是这个雷点确实让人有些失望.再等等,先用着opencode的Muse Spark,后续说不定又有哪家有更合适的套餐

* 帖子来源Linux.do
返回