范式革新? openai 新模型 astra 采用了新的推理技术

天上火 2026-09-02 10:31 1

简单来讲,这种技术和传统显式 cot 思维练最大的区别就是推理完成过程完全压缩在模型内部,这样的好处是推理深度大幅度加强,内存开销大幅度降低,坏处就是无法监察模型内部思考过程,你不知道模型完成任务时到底在想什么



https://www.theinformation.com/articles/secret-technique-behind-openais-astra-model-sparks-security-concerns


astra 这么强的原因可能就是因为这个技术了,从流出的结果来看,哪怕 fable5.1 都感觉和 astra 差了一代


最新回复 (19)
  • 白泽 09-02 10:32
    1

    怪不得奥特曼敢说AGI,这么看来好像确实有点东西

  • penny66 09-02 10:34
    2

    希望尽快发布 给a/多点压力 让a/估值压低

  • wpy 09-02 10:40
    3

    loop transformer?

  • hehe 09-02 10:42
    4

    赶快端出来吧,吹了半天用不上又啥用 ^-^

  • ishadows 09-02 10:42
    5

    是这样的话,思考是不是不会额外按Token收费了?

  • 砂銀 09-02 10:43
    6

    听起来挺像之前的 pro thinking啊

  • LaoDa9527 09-02 10:43
    7

    每次都说的很牛逼,实际稍微牛逼一点

  • coolcloud 09-02 10:44
    8

    一箭三雕啊

    这下那些偷思维链蒸馏的 是不是就彻底防住了

  • Kotone 09-02 10:47
    9

    ^-^要真是这个水平那AGI确实要来了

  • WWT 09-02 10:48
    10

    真的假的?要是真的就好了

    AI又开启一轮新的激烈的斗争了(误^-^^-^

  • 余君 09-02 10:48
    11

    这么说价格方面不会提升太多?毕竟节约了不少显存

  • 古月方源001 09-02 11:09
    12

    估计又是宣发最早,上线最晚了,oa特色了

  • unsafetrait 09-02 11:10
    13

    也就是说,它以后删你文件之前甚至没有个预警直接就删?回滚你GIT仓库的时候毫无征兆?嗯嗯,真棒呢

  • TIlO 09-02 11:12
    14

    他怎么思考跟能不能执行是两回事吧^-^能不能直接执行是harness的事

  • 擎伞驻阡陌 09-02 11:14
    15

    奥特曼敢说AGI是因为他一直敢说AGI

  • 曜一 09-02 11:15
    16

    这样的话模型能力更强,但是不知道它在想什么会不会引发安全问题呢

  • lueluelue 09-02 11:16
    17

    如果是这样的话,那 OpenAI 是怎么监测的呢?他们还说对齐有很大进步


    会不会是烟雾弹啊

  • 擎伞驻阡陌 09-02 11:16
    18

    你能看到的实际处理内容,也是模型的正式输出内容,他的意思是原来的<think>部分压缩到模型里面了,也就是向量循环传递,而非token解码后的内容进行传递。相关的论文很早就有了

  • Moonie 09-02 11:18
    19

    latent token? 听起来也不是很新,倒是放工业界使用挺新奇

* 帖子来源Linux.do
返回