看了一堆astra测试,agi可能已经到来

羽织 2026-09-06 11:51 1

上午看了一堆astra的测试

包括但不限于:



  • 全自动建模+自动操控blender渲染视频

  • 给一个小地图,全自动建模出可以游玩的dust2

  • 全自动用svg线条分步绘制二刺螈图片,完全能看

  • 全自动用computer use操控鼠标用ps给图片上色

  • 强到离谱的html建模测试

  • 用astra自己做一个好听的音乐

  • 全自动arcaea写谱

  • 视频制作


相关视频在b站和x都能搜到


已经超出了我对于一个大语言模型的能力想象


我传统一直以为这种模型只能在文字代码上有大进步

但是目前来看,视听能力也强到离谱

配合computer use,动手能力也很强

最新回复 (19)
  • cainiao3hao 09-06 11:53
    1

    建议直接进工程用用,还是有一大堆问题的,总是容易早停,加上随机降智,挺难用的


    距离AGI还是有不小距离的,不然fable那时候就AGI了,现在不也没怎么样

  • 兰子p 09-06 11:54
    2

    正在跑着goal重构呢,没啥问题呀,也没降职

  • Enze 09-06 11:55
    3

    https://linux.do/t/topic/2861144/8?u=enze


    缺少严谨定义的东西永远也不会到来,而且也没有强大到可以在实际工作中完全脱离人工干涉

  • 还想成为88VIP 09-06 11:55
    4

    过誉了,虽然astra确实好用,但是也并不是不会出现问题,但是这确实是代码以外领域最好的了。这种测试意义有限,实际用起来,并没有强到那种程度

  • cainiao3hao 09-06 11:55
    5

    Goal确实据说会好点,不过我用的pi,没有goal


    之前的模型不管哪个用goal都容易走偏,就觉得实在是没必要

  • 兰子p 09-06 11:57
    6

    blender 3d建模这块据群友反馈应该是远超fable之类的了

  • Enze 09-06 11:58
    7

    之前的模型不管哪个用goal都容易走偏



    https://linux.do/t/topic/2859805?u=enze


    新模型 Astra 和 fable 5 在长任务上的进步还是很大的,不过 goal 指令是会一直注入对话的,所以要足够严谨

  • 还想成为88VIP 09-06 11:59
    8

    我不觉得fable有多强,但是我现在意识到这可能是因为我不是码农,所以视角有偏差,我自己体验起来fable5.1并不好用,如果不是sol太难用我不会用fable的

  • 你说蓝色是你最爱的颜色 09-06 11:59
    9

    我的astra high模式为什么用computer use连帮我调个QQ音乐的音量到百分之百都做不到

    我是plus账号,难道给我降智了吗

  • cainiao3hao 09-06 11:59
    10

    另外降智,我现在是没遇到,但看见不少站友都遇上了,回答也是清一色的说降智


    主要这才模型刚出来,5.6那时候都没这样 ^-^

  • umda 09-06 12:05
    11

    确实看到明显的进步,感觉AGI之后会成为新一轮模型升级用的营销用词语了

  • koclob 09-06 12:08
    12

    为什么不用codex app 自家的模型当然自家最好用

  • lissss 09-06 12:08
    13

    openai 称agi不是为了和微软的合同吗?声称agi后重新拟定合同

  • mark 09-06 12:10
    14

    但是我还是不知道什么叫做AGI.

  • hamflx 09-06 12:10
    15

    以后每次模型厂发版本,AGI 都会到来一次。AGI 到来将成为常态。

  • hamflx 09-06 12:11
    16

    虽然,你仍然因为 Astra 给你写一坨代码骂他蠢货 ^-^。

  • wilsons 09-06 12:12
    17

    和 agi 差距还很大

    https://linux.do/t/topic/2860100

  • jue 09-06 12:13
    18

    astra token效率高,加上工具调用能力好,所以在游戏制作方面可能优势大一点,但是我说实话,我用了下,前端审美还是差fable一大截,然后agi的话,这不是扯呢吗

  • cainiao3hao 09-06 12:14
    19

    因为之前5.5末期的时候发现codex的提示词本身就会导致降智做不出糖果题,就提示词里实时向用户汇报进度那段,更容易触发think截断的降智,加上pi的简洁跟切模型方便 ^-^


    降智是肯定降智,但codex的提示词会让它更容易触发降智,当时还有改system prompt的帖呢,从必降优化成基本不降,后来才研究出降智的原理,也是随机降智的 ^-^

* 帖子来源Linux.do
返回