Astra的效率太可怕了,跟那些拉皮超频雷霆大思考的货色就不是一个时代的

ikb 2026-09-04 22:00 1

此帖子已被社区举报,现已被临时隐藏。

最新回复 (19)
  • Zeraphine 09-04 22:02
    1

    还是得看实际体验,sol刚出的时候也是惊为天人,一周后就拉了

  • 在学OCaml 09-04 22:03
    2

    要是 Astra 还是像 5.4-5.6 那样不说人话+各种防御性代码, 那就还是不好用

  • ce silen 09-04 22:04
    3

    还没用上呢,真出了再说

  • 草冢 09-04 22:04
    4

    还没用上啊,希望Plus用户晚几天用,多发几张卡。

  • heymeow 09-04 22:05
    5

    用a\的很多时候就是图它讲人话,敢反驳,经验丰富,gpt基本就跟上面这几条相反

  • microsoft2333 09-04 22:06
    6

    我觉得还是等几天看实际表现后再说吧

  • Kassdin 09-04 22:07
    7

    没必要贷款赢,实际体验和跑分还是有区别的。

    即使这图这里看起来 sol max token 效率也不低,真写代码做实验就开始checksum,sha256 ,硬编码全给你上一遍。真实场景里面,sol high 照样雷霆大思考,也就 codex 把思考工具给你缝一起看不出来罢了

    想想为什么 opus 明明跑分榜单里输出更多的 tokens,但是实际体验大家都觉得 gpt 慢,claude 快?

  • ikb 楼主 09-04 22:08
    8

    我从sol发布以来基本上sol max 24小时跑到现在,没感觉到有什么能力波动。平时动辄一个commit都是几万十几万行diff,降智了根本干不动。

  • 霞葉 09-04 22:09
    9

    这话说的,我还以为你用上了呢

  • puppywang 09-04 22:09
    10

    现在测评大模型也都改成云测了么?我本来满心欢喜想看一个实际体验结果,进来一看,居然是截图, 这也太魔法了…

  • 利陆都2253 09-04 22:11
    11

    我还以为你用上了,看跑分云测可还行,等用上再吹一波不迟 ^-^


    如果光看跑分,你为啥不吹图片里面的哈基米 3.8 flash?

  • szzz 09-04 22:11
    12

    说好的推送呢?中文互联网我就还没看到一个真用上的

  • Dc18 09-04 22:13
    13

    (帖子已被作者删除)

  • neco-Arc 09-04 22:16
    14

    中间夹个gemini3.8-flash,我就知道这天梯图也就图一乐,还得看实际体验

  • ikb 楼主 09-04 22:16
    15

    佬喜欢opus就去用呗。我平时用起来opus5就是屎味的屎,跟巧克力都不沾边。

  • ceshi01Adx 09-04 22:17
    16

    我在想它是怎么做到的?别的要进行100多次工具调用他才20多次?

  • sis5595 09-04 22:18
    17

    俺也一样,俺的代码用terra就行,俺不需要那么好的模型

  • lueluelue 09-04 22:21
    18

    平常的prompt不可能像benchmark那样细

  • jcc 09-04 22:21
    19

    反正最近的gpt,从来没让我省心过


    以至于team 号都闲置了,一直在用glm


    我用大模型不是要和他对线帮他检查问题的。。。gpt纯是闹心

* 帖子来源Linux.do
返回