周末刚入手了ollama cloud pro实测

LLMcoder 2026-08-25 21:39 1

周末才订阅的ollama pro,测试了几个常用模型, dspro-0813解决问题能力的确在线,和我用质谱官方GLM-5.3有接近的体感,解决问题准确度很高。



但是如果用dspro-0813 开始的上下文超过300k,那么第一次请求占用的额度相当的大,我有一次在glm5.2 500k上下文的时候切了dspro-0813, 一次请求干掉了9.6%的5小时额度, 所以用ollama 订阅的高阶模型之前得先清一下上下文。 从10k上下文左右开始跑的话,5小时额度可以核算到130-150请求。 我看有些大量用dsf0731的,在实际解决问题的时候,还是有不少瑕疵的,不知道佬们是用哪个agent配合dsf0731提升战力的?

最新回复 (8)
  • crazycrazyshui 08-25 21:51
    1

    pro不是说连flash都打不过吗


    也就是说,实际上最重要的就是避免长的上下文,使用ollama ^-^

  • LLMcoder 楼主 08-25 21:53
    2

    实测pro0813是能和glm-5.3一个梯队的。 一定要清上下文,一个session开始的时候上下文多了就是噩梦,5小时量直接就会被干到40-50了。

  • leonvxe 08-25 22:02
    3

    500k就干掉10% 这额度也不多啊,20刀

  • Sam Altman 08-25 22:08
    4

    因为它突然切模型,这么长的上下文毫无缓存

  • Sam Altman 08-25 22:10
    5

    据有的佬友说,Ollama 如果刻意维持 100k 以内短上下文的话,可用额度相当恐怖,glm5.2可以达到 12 亿的月限


    https://linux.do/t/topic/2788253/11?u=adamsmith

  • 08-25 22:10
    6

    感觉应该是说性价比不如flash,不至于打不过吧。。。。。。就是flash太好了,让大家对Pro预期过高了

  • Sam Altman 08-25 22:13
    7

    但是如果你订阅了 ollama,不推荐用 V4 Pro ,性价比确实不高,因为它官网说是按 GPU 计算时间来计消耗额度的, Pro 模型的参数太大消耗速度很快,而实力却没有拉出 GLM 5.2 多少,因此我个人认为不推荐使用 Pro 模型

  • 08-25 22:16
    8

    所以加上官网涨价,好像现在基本上没人用V4 Pro了吧,也没有什么订阅套餐比较合适用

* 帖子来源Linux.do
返回