寻找一个验明模型正身的项目

yanyuol 2026-06-16 10:16 1

我发现我用了几个中转的模型感觉都不太对,对比官方的模型总感觉不对,我经常使用的是国内模型,想问问佬们,有没有开源项目验明正身的

最新回复 (15)
  • Tidibuddy 06-16 10:18
    1

    现在都已经进化到随机掺水了,你难道每一次请求都去验明真身?没有用的,自己开官方吧

  • 白泽 06-16 10:20
    2

    只能靠特征来鉴别,但是鉴别方法和反鉴别的掺水方法都在与时俱进,想要确保100%不掺水只有官订

  • yanyuol 楼主 06-16 10:22
    3

    看来没有好的办法了,只有走官方模型了

  • yanyuol 楼主 06-16 10:23
    4

    确实我也感觉到了,防不胜防啊,看来中转只有走知名中转了,怕了怕了

  • 疾风 06-16 10:37
    5

    看来没有好的办法了,只有走官方模型了



    说实在的官方都在降智,简直无解啊。

  • 白泽 06-16 10:38
    6

    降智归降智,掺水归掺水,还是不一样的

  • yanyuol 楼主 06-16 10:39
    7

    不是,对比下来我使用的中转和官方模型出来的效果差很多,所以才有了这个帖子

  • 白泽 06-16 10:41
    8

    如果是中转claude的话,很可能是kiro反代的,kiro的内置提示词导致反代出来的claude在其他地方都不好使

  • freeqbar 06-16 10:44
    9

    ^-^昨天发现一个很神奇的提示词,kiro、awsq、amazon bedrock、cc max里的opus 4.6、4.7、4.8的表现都不一样,测了好几轮都很稳定地出现差异

  • HanJiang 06-16 10:50
    10

    当你自己感觉到不对,并且觉得模型输出奇奇怪怪的时候,就不需要利用三方工具进行验证了,因为基本可以确定掺水了。

    当然,这要建立在你自己用过一段时间官方订阅的基础上,之前我朋友让我试试某个中转站的5.5,high上来就是一段英文思考,然后回复没有gpt味,我就知道这是deepseek来了 ^-^,切到xhigh又变正常了

  • tienchiu 06-16 10:52
    11

    用英文thinking是ds的特征?

  • HanJiang 06-16 10:54
    12

    GPT显示出来的思考内容一般都是和你对话的语言,而deepseek我个人感觉非常喜欢英文思考,不管是web端还是API

  • a12908 06-16 10:56
    13

    没有的 这是世界难题真有能准确验出来的话怕是大部分的中转站都得暴毙了 ^-^

  • yanyuol 楼主 06-16 10:57
    15

    所以,我发现很多人说模型不好用,很有可能就是被这种中转误导了,我在使用国内比如glm,ds,qwen用官方模型都能按照要求处理我的任务,反而切换到我经常用的中转后,在某一段时间内她就间接性变得傻傻的,不按照要求去执行了,过了这一回他又好了,还有,我在测试中发现,原本纯正模型首字需要5秒左右,当首字出现2秒或者1秒的时候,我就知道又变了,一开始我以为是没人去抢资源变快了,后来发现我太天真了 ^-^

  • tienchiu 06-16 11:03
    16

    刚在warp上测试了一下,相比qwen,ds的确偏向于英文thinking。


    不过不排除因为warp的语言原因

* 帖子来源Linux.do
返回