近月来,国内多家公司的最新模型相继发布,实在是可喜可贺。
因此我也是东拼西凑的蹭了些模型去尝试了这些模型的能力。以下内容带有主观感受,并且由于钱包原因,部分厂商模型没能进行体验,因此无法列入讨论。
首先先说说deepseek,这算是我用的第二久的的国内模型了。
新上的deepseek-v4-flash正式版的功能相对于预览版有了极大的进步,我觉得表现在以下几个方面:
- 长上下文的稳定性。在810k的上下文下,deepseek依然表现很稳定,在max的思考强度下上下文召回率相较于v4-pro-preview更高,且不容易胡言乱语
- 定价相当的便宜,官方的定价在缓存命中(缓存读取)的情况下非常的便宜,中等强度使用钱包压力不大
- deepseek的tool call比较稳定,不容易出大问题
补充一点:如果你看到某家的flash总是飙一些你看不懂的语言,还时不时岔开话题自言自语,或许他家用的是英伟达渠道的deepseek(下图就是,依旧爱洗澡,想睡觉?)



其次是GLM模型,这也是初期非常看好的模型。我在多个公益站都用了GLM-5.2模型,总结如下:
- 高峰期的可用性不好,有时出现排队或者错误
- GLM-5.2的模型属于编程特化的,编程能力很强
第三是Kimi,我接触时间不长,但是他的模型编程能力比opus-4.8还夸张…
但是我使用次数也很少,渠道真的很难搞
最后想和各位佬友说句掏心窝子的话,或许你还在用gpt和claude解决很多问题,但国产模型真的很强也很有性价比,有机会真的可以试试国产模型!