openai官方 gpt astra帖子发完貌似秒删

Not_Found_404 2026-09-04 02:47 1




貌似长上下文能力更强了



其他方面




网络安全


疑似官方帖子的图片










定价可能跟fable 5一样

最新回复 (13)
  • ishadows 09-04 02:53
    1

    openai这到底什么意思啊,发了又删的,不会是astra在负责自己的发布吧?

  • Not_Found_404 楼主 09-04 03:01
    2

    不知道,我在x上陆陆续续看到了不同的测试图

  • 𝕂𝔼𝔼ℕ𝔼ℂℍ𝔼ℕ 09-04 03:03
    3

    woc,肥波5原来这么强差一代都还能持平

  • IkedaTeresa 09-04 03:03
    4

    @lueluelue 这里有疑似官网原帖的截图.

  • DFobainx 09-04 03:06
    5

    尴而尬之


  • 吃风筝的人 09-04 03:08
    6

    astra就这还藏着掖着,限制性发布


    当时5.6也说对台肥波5来着,吹的可热闹了。后来呢?


    差了整整一代,图上根本看不出差距……

  • laokke 09-04 03:09
    7

    我也用过fable5 也没有一代那么大吧..

  • Not_Found_404 楼主 09-04 03:11
    8

    如果这些基准测试保真,写代码可能也就是比fable 5.1 强那么一些。



  • BlueFunny 09-04 03:12
    9

    感觉没那么夸张,差距肯定有,但主要是方向上的差异(一个倾向于结果不管过程,导致代码没人能看得懂,另外一个倾向于过程而导致结果可能不让人满意),最终效果其实差不多的,而且 sol 比 fable 也便宜不少

  • lueluelue 09-04 03:12
    10

    其实我特别好奇,为什么Polymarket上面赔率还是这么高

    按说如果那些新闻网站说的是真的,只给企业客户中的Daybreak Trust Access 访问,那不应该结算为Yes呀

  • 吃风筝的人 09-04 03:12
    11

    主要肥波5是5.6时代的东西了。这个astra可是刚发。对标也得是5.1时代的


    LLM迭代速度又快,这几个月还真就差出来一代了

  • skyblu 09-04 03:13
    12

    有一说一 MRCR是和我使用体感最接近的benchmark 狠狠期待了

  • Not_Found_404 楼主 09-04 03:17
    13

    我一般是限制在500k内,个人感觉是比ds的上下文能力强,

* 帖子来源Linux.do
返回