主要是和ds 4.1f对比,前端审美和任务交付效率占优。
推理水平一般,和同行差不多
幻觉高才知道我用的是豆包,符合刻板印象
在同行都投入进雷霆思考军备竞赛的环境下别树一帜
模糊具体部分是我个人的理解,与nao无关
帖子最后给出网站的benchmark:
国产模型,我个人老是感觉glm聪明一些