贡献俩astra实际用例

远坂凛的宠物 2026-09-05 04:50 1

用例1


让它写个小声控电脑demo,gpt最擅长的一句话许愿场景

还给了三轮对话提醒的机会改ui,做出来的ui长这样

总之还是跟5.5一样把提示词堆ui上,并且完全不考虑做出来的东西是给人用的,主次不分,漏/错了什么东西被用户提醒了,就会把那个东西做得特别大,盖过软件真正的核心功能……

前端比fable差远了,依然不如k3

我已经能想象把已经存在的史山给它迭代会发生什么了

大失所望又不出所料



用例2


找东西,在adobe photoshop沙盒环境写脚本,用实际最后更新时间为1999年的祖传残疾的api拼需求,资料很少,什么都需要靠试,接近逆向的场景。

比5.6好,极高思考级别语言能力不会退化,能说清发生了什么。

做不出来知道放弃,不会像5.6一样一直试,最后忘掉了自己要干什么,偷换最初的需求单方面宣布胜利。

语言能力还可以,能把干了什么和要干什么扯清楚了。比不了fable和k3,至少不会一直“你说得对。”然后绕来绕去来气人了。


成本


demo花了10m,20刀有点意外还挺省的

算上缓存实际消耗大概是sol的2.5倍

但是因为token更少,所有最后的消耗基本持平

不过我估计在需要大量读文件的场景可能会使周限如奶油般融化。

最新回复 (4)
  • 拾叁 09-05 04:54
    2

    这两个测试用例和评价


    比起铺天盖地的svg测试,“震惊” “天塌了” 观感好一点

  • 远坂凛的宠物 楼主 09-05 05:10
    3

    ^-^毕竟咱一般用不上画鹈鹕和一句话生成。

    感觉在用户对交互流程和执行细节限制得比较细的场景一直不太受重视啊……

  • 天怒 09-05 05:19
    4

    核心痛点还是没有任何的改变啊。 看来别指望它写网页了。^-^

  • 远坂凛的宠物 楼主 09-05 05:21
    5

    好像别的佬网页还是可以,毕竟是最大的训练集……

    桌面小软件主要看的不是外观设计能力而是交互/流程设计能力,目前看起来不提醒完全没这方面意识

* 帖子来源Linux.do
返回