v4-pro 正式版这 不是...而是 给我气笑了 rp感觉零区别啊

mi tu 2026-08-13 01:46 1









一共说了两句话,回我39个不是(包括思维链

tps倒是不慢



合着rp也还是这味,我们rp区的未来…(哽咽

等会儿试试grok4.6 ^-^

grok4.6是大份啊

至此没有任何期待中可以愉快rp的模型了 ^-^

最新回复 (19)
  • Hifumi Mizuhara 🍥 08-13 01:47
    1

    本来后训练也不可能是后训练RP啊,反倒如果大量训练代码可能还有恶化风险

  • mi tu 楼主 08-13 01:49
    2

    这不期待奇迹中吗,灰测里我看opencode的分享聊天记录一个不是而是都没看到还挺期待的= =,看来rp真的没有未来了

  • Hifumi Mizuhara 🍥 08-13 01:49
    3

    很难有,所有模型都在卷agent,感觉Grok应该也不会太好(没试过,猜想)

  • WWT 08-13 01:50
    4

    除非有公司专门训练这方面的模型 不开倒车就算不错了

    目前发现编程特化的模型几乎这方面都是倒车请注意

    而且其实得益于正式版推理能力加强了 我个人体验觉得反而更好一点

    之前预览版经常会因为提示词犯胡同 或者分不清角色人物

  • mi tu 楼主 08-13 01:51
    5

    grok甲有点厚,破甲之后和4.5差不多不太像人类^-^

  • mi tu 楼主 08-13 01:52
    6

    这么一说现在体位起码对了,空间位置这一块确实好了点?

  • xiedian 08-13 01:54
    7


    我看b站的评论说减少了不少

  • WWT 08-13 01:55
    8

    yes

    之前预览版不管是Pro还是flash都有一个问题 比如说当故事推演到一定上下文之后 场景会变得愈发复杂

    我会丢给他几段 分别是两个主角的对话 没有人称代词什么的 但是符合两个位主角的行事以及说话风格

    一般推理能力弱的模型在这里就boom了 他们输出的文本 有不小的概率没有对应上各自的人物

    不管是预览版的pro还是flash

  • mi tu 楼主 08-13 01:57
    9

    额,我这张卡新开的对话和之前的预览版对比感觉没啥区别,就楼上说的空间关系更好了点,不是而是看图可知,我预设用的很老的精简预设,没有去八股和去不是而是倒是 ^-^

  • Tado 08-13 01:58
    10

    到现在也没有看到 DeepSeek 官方的推送,都是小道消息,只是改了文档,也没有说明路由到了正式的pro 了,大家就开始测了。

  • WWT 08-13 01:59
    11

    货应该是真的

    但是好像看佬友们也有概率路由到预览版

    脏token检验过不了

  • Mulin_Zz 08-13 01:59
    12

    主模型还得用 4.8o,ds 就滚去额外模型解析吧

  • mi tu 楼主 08-13 01:59
    13

    哥们分词器都改了,群截图也有官方的跑分之类的了你多看几个帖子就知道了

  • mi tu 楼主 08-13 02:00
    14

    要不是claude封号我也不至于买openai,gpt用作rp等于吃大份 ^-^

  • Hifumi Mizuhara 🍥 08-13 02:01
    15

    我的就还是不能识别Nameeee

    等待一下官方官宣吧,应该Harness也会出来了

  • ceacm 08-13 02:03
    16

    v4p我一直感觉就不太好使 v4f作为小模型很好用,v4p多想的部分有点乱

  • WWT 08-13 02:03
    17

    对的

    所以我才想说要不要劝一些佬们不要测了

    别到时候测完才发现,竟然混了不少预览版

    钱白花了^-^

  • Mulin_Zz 08-13 02:04
    18

    可以用一些公益的克或者反代的克啊,残血也比其他的强不少

  • mi tu 楼主 08-13 02:05
    19

    我不用中转玩酒馆的,日志之类的十个问题,自己反代门槛有点高 ^-^,我还是吃ds吧起码速度挺快的

* 帖子来源Linux.do
返回