现在没有针对gpt-6-astra后端编码的体验测评吗?

qq124415 2026-09-07 10:53 1

现在基本都是gpt-6-astra前端的测试,还有一堆xx骑xx的svg测试,本来想自己测试一下结果看了输出的鹈鹕也不敢用了,还是说相对于gpt-5.6-sol没有明显提升吗?

最新回复 (19)
  • mr-xintian-du 09-07 10:54
    1

    似乎它的提升不在编码能力上(我在音符看到的评测)

  • 照我满怀冰雪 09-07 10:56
    2

    如果前端测试出来是正常的,那它后端应该水平也不差吧。

  • qq124415 楼主 09-07 10:56
    3

    kimi-k3就是典型的前端好,后端一般的模型

  • sczerg 09-07 10:57
    4

    大家都在用computer-use吧,纯后端有点浪费TOKEN,还不如切到便宜的5.6 sol。

  • rollbin 09-07 10:57
    5

    一个是价格确实很贵,即使是pro20x用astra也只有1600刀左右的周限


    另一个astra的看现有的测评,提升更侧向于前端审美和建模吧

  • 照我满怀冰雪 09-07 10:57
    6

    但这个是OpenAI呀,kimi可能想着先全力以赴攻克某个领域,OpenAI不至于。

  • 夜雨 09-07 11:00
    7

    OAI后端能力一直都不差吧,挠头

  • 照我满怀冰雪 09-07 11:01
    8

    所以我觉得只要你前端测试骑自行车没降智的话,后端水平肯定是在线的。只要总体水平在线的话,后端也不会太菜。

  • qq124415 楼主 09-07 11:01
    9

    后端能力不差,但过度思考和防御性编程的问题还是存在,特别是在项目后端的规划阶段。

  • Lz_Mar12 09-07 11:02
    10

    gpt-6-astra 感觉在html中,前端建模也不错 GPT-6 Astra 大大的震惊,两个场景美到爆

  • 夜雨 09-07 11:02
    11

    这倒是,我在写提示词时经常需要补充"请勿过度设计",plan mode + 执行才是我的工作流程

  • 可爱归归 09-07 11:03
    12

    我不知道是不是因为astra前端能力的大提升,导致这个模型对e2e测试已经入魔了


    具体就是你无论改什么只要你的服务有客户端内容都会得给你开个localhost再开个浏览器给你点点点点


    什么,你说你的服务没有GUI?别急看我直接在codex重新画一个:

  • 不是不思考 09-07 11:03
    13

    5.6sol就经常过度设计^-^防御性编程。他不是没有能力,他是训练出来恶心人了。

    前端和后端能力没有强相关啊。

  • qq124415 楼主 09-07 11:04
    14

    gpt-5.6-sol一样的,提示词都写明了由我自己测试浏览器效果,还是要先开个浏览器

  • 水凉 09-07 11:05
    15

    computer use 不是很消耗token吗?^-^

  • Abruzz1 09-07 11:05
    16


    从codex雷达上来看的话, astra低effort表现还可以

  • 夜雨 09-07 11:05
    17

    能力内化了,以前的superprower在gpt5.6-sol刚出来的时候我没移除,让我多跑1kw token一个问题

  • cloudwind 09-07 11:08
    18

    这这这,更省了啊。。。

    说啥的都有,搞不清了。。。

  • qq124415 楼主 09-07 11:10
    19

    所以我想要的是gpt-6-astra加入真实项目的“体验”测试,分数太虚了,只能对比模型间的强弱

* 帖子来源Linux.do
返回