字节 Seed-2.1-Pro 0915 测评 【nao榜转载】

listening 2026-09-17 19:25 1





主要是和ds 4.1f对比,前端审美和任务交付效率占优。





推理水平一般,和同行差不多





幻觉高才知道我用的是豆包,符合刻板印象





在同行都投入进雷霆思考军备竞赛的环境下别树一帜




模糊具体部分是我个人的理解,与nao无关



帖子最后给出网站的benchmark:

最新回复 (1)
  • zlingxi 09-18 03:47
    1

    国产模型,我个人老是感觉glm聪明一些

* 帖子来源Linux.do
返回