v4.1f high在dsh里智力比astra都高?为何如此?

cqting 2026-09-14 16:14 1

如果是这样,我现在codebuddy有订阅 能不能反代出来给deepseek harness 的cli版本用呢 目前用的是codebuddy cli 一眼claude code改的



最新回复 (19)
  • xiedian 09-14 16:16
    1

    智力不代表能力吧?我感觉只能同模型比智力,跨模型比智力不可取

  • 小匠 09-14 16:16
    2

    咋会,我觉得还是有差距的,不降智的6效果很好

  • cqting 楼主 09-14 16:17
    3

    比在claude code里聪明就行了 不在乎和astra比了 肯定比不过

  • 天天开心 09-14 16:18
    4

    我感觉V4.1flash智商在线,但是比较活泼,思维发散,astra就是稳重一些,像中年大叔

  • cqting 楼主 09-14 16:19
    5

    看测评或者看这个雷达 dsh的智力比在其他的地方智力高很多,目前就在想能不能反代出来给deepseek h 的cli版本用

  • WizisCool 09-14 16:20
    6

    CPA就可以,让v4.1f 自己写个CPA插件即可

  • cqting 楼主 09-14 16:20
    7

    OK,多谢佬,了解了,现在去搞一个

  • DIAVE971 09-14 16:21
    8

    啊?还能这么玩?求佬带带,我也想上车

  • WizisCool 09-14 16:21
    9

    不过codebuddy的v4.1f是有用量限制的,大概每天只能花个200积分这样

  • eugene 09-14 16:22
    10

    画个鹦鹉看看

  • Nazo 09-14 16:22
    11

    ^-^已经不相信这些测评了。

    只有自己真实使用才知道是什么样的

  • a12908 09-14 16:24
    12

    这不是评测 是实测 是用户自己的号挂上去跑出来的

    你不服可以把你自己的号都挂上去做题 跑出来是多少分就会记进去

    这还不够实际使用吗 ^-^

  • cqting 楼主 09-14 16:24
    13

    我开了70块钱的版本,应该没有限制的吧 上次限制了之后我开了就没限制我了

  • cqting 楼主 09-14 16:26
    14

    这肯定比不过,不知道这个测试是测试了什么数据集,我看说是用户自己的号挂上去做题出来的分数

  • 林黛玉倒拔垂杨柳 09-14 16:26
    15


    刚看到一个,丢个 PDF 让 DS 翻译,DS 反手就把任务外包给了 Opus 5,然后作者的 300 余额没了。

  • ABcopilot 09-14 16:26
    16

    这个数据可不可靠,意思是v4.1f的max不如high?我这么多天都用错了吗 ^-^

  • eugene 09-14 16:27
    17

    简单的测试集对于近期发布的模型没有意义

  • ikb 09-14 16:27
    18

    Astra这个分数都快赶不上前段时间的luna了,不知道混了多少降智版进去,不用太在意。

  • cqting 楼主 09-14 16:29
    19

    6666 我还记得之前v4f的时候 自己下载qwen开源模型部署然后外包给qwen哈哈

* 帖子来源Linux.do
返回