一句话测出你的火山方舟coding plan是否灰度到了字节新模,1/3概率灰度

羽织 2026-06-23 03:25 1

灰度到的概率很大,大概是1/3


其实只需要随便发一句话就行,模型选择glm-5.2,比如:


你好

然后只需要看输入token数:



  • 灰度到是14:


  • 没灰度到是13:


  • 智谱官方是13,和没灰度到一致:



实际上你用其他的提示词去测,差距更大,比如:


你是什么模型


  • 灰度到是18:


  • 没灰度到是15:


  • 智谱官方是15,和没灰度到一致:



同样的输入内容,token数和分词器都不一样,不用多说什么意思了吧


结合昨天seed 2.1的消息,不难猜出字节在coding plan上面灰度新模型,估计也是提升了coding能力,可能是想和glm-5.2进行pk


而且除了上面看token数的最直接的区别,两个模型还有下面的区别:



  • 字节新模比较热情,用emoji比较多(输入token是19):


  • 而glm-5.2就比较冷淡,不怎么用热情,不喜欢用emoji回答

  • 下图为非灰度版本(输入token是15):


  • 下图为智谱官api版本(输入token是15):



还有下面很明显的区别:



  • 字节新模默认是关闭思考

  • glm-5.2本身不传思考参数,默认是开启的

  • 从最开始的token统计里,reasoning_tokens就能看到二者区别,更加说明是两个模型了,灰度到的显示0,没灰度到和官方的是100多




据说新模coding能力也比较强,与4.6op相当:


[image]


而且有人也有一些测试,确实不错 ^-^


赶紧去测试一下你的火山方舟有没有灰度到吧 ^-^


火山方舟正常付费api和agent plan没有测试,有被灰度到的佬可以提醒我一下

最新回复 (3)
  • 欣欣|林可欣 06-23 03:27
    1


    • 下图为非灰度版本(输入token是15):


    • 下图为智谱官api版本(输入token是15):




    综合观察两张图上面的API地址,我觉得你这两张图好像放反了 ^-^

  • zhongruichen 06-23 03:50
    3

    agent plan我这边有人反馈也会有灰度,另外这个灰度的模型,你请求思考的话就不会思考,如果你请求了思考就是自动思考,自动思考就是简单问题不思考,复杂问题才思考

  • 羽织 楼主 06-23 04:00
    4

    没有,我测了一下,不传思考强度,他是不会思考的

    测simplebench他都没思考

* 帖子来源Linux.do
返回