对于 GPT-6 SOL 模型的失望:远不达预期

StarFox 2026-09-23 12:14 1

就在昨天,OpenAI 发布了 GPT-6 SOL 和 GPT-6 Luna 2 款模型,纯属于是 SOL 和 Luna 在 5.6~6 之间的常规迭代,没有发 Terra,大概率是想通过 SOL 直接取代原来 Terra 尴尬的位置。


个人测试了一下,说实话,对此款模型感到强烈的失望。在原先的预期中,根据 astra6 的卓越体验,大概率是判断为 astra 可能采用了新的技术或者重新训练的基底。所以说 astra 整体来说更偏向于 AGI 一点,而且代码风格也显得不同,智商显然更高了。因此,基于之前基于 astra 的预期,是 GPT-6 系列模型整体均以 astra 的基底做再训练,相较于 GPT-5 系列应该是脱胎换骨式的提升。


但在前面的灰度测试中,通过模型指纹做相对不严谨的测试,会发现 6 SOL 的指纹在指纹库里通常显示为 6 Astra 的指纹和 5.6 SOL 的指纹五五开。但是指纹相对来说没有那么严谨,可能说明不了什么,但也能大概地推测出 6 SOL 是有从 6 Astra 上面提取能力的。


但在实际使用过程中,发现 6 SOL 更像是从 5.6 SOL 上面的原地迭代,而并非重新构建的底部。因为 5.6 SOL 中包含的各种小毛病,比如说极强的防御性开发,还有各种各样不说人话的技术词语,基本上陋习全部继承。


而且根据题库测试等测试来看的话,6 SOL 的编程能力从整体上来说,基本上就是在原地踏步,很少说有从 SOL 到 Astra 那样的飞跃,整体来说的升级幅度也是差强人意。


而且根据不严谨的指纹测试,现在发现正式版本的 6 SOL 的指纹更倾向于四成的 Astra、三成的 SOL 还有三成的 5.5,这更不免让人怀疑 OpenAI 是不是在对于 6 SOL 挤牙膏。整体来说也就干一些,也就是比上一代 5.6 稍微强了一些,其他地方不能对它抱有太大的实际使用中的希望,仍然是以 Astra 为主最好,达不到 OpenAI 在 Adobe 体系里所能够承担的能力。

最新回复 (19)
  • Morli 09-23 12:16
    1

    主要是吧,openai这两个星期疯狂的大炒作,结果最后模型能力没长进,价格砍了一半

  • RzMY 09-23 12:17
    2

    可能是看到A\发布有些急了吧,端了个半成品上来,后面可能会有热更新?

  • StarFox 楼主 09-23 12:17
    3

    但是其实要说 astra 降价砍一半,那我会很高兴。但是就 5.6 SOL 这个能力来说,还有它之前的价格也不是很合理,这使它哪怕是腰斩,价格也没有体现出它的特色。


    相较于此,我更希望是一个价格不变更加强大或者更加精确的模型,或者说是哪怕价格提升 50%,但是却能力更强的模型。我也不想要这个模型降价但是毫无进步。

  • StarFox 楼主 09-23 12:18
    4

    我猜热更新更有可能是降智。现在刚发布的时候的水平一般,按照 OpenAI 的尿性,如果一个模型刚发布时候的智力都不行,后续热更新顶多是降智,不大可能会提升

  • runner dhero 09-23 12:18
    5

    本质上就是terra系模型改了个名,然后把原来的sol删了,改成astra了

  • Morli 09-23 12:19
    6

    现在充其量算个5.6 sol降价活动了。astra那个api价格实在太离谱。而且openai不透明的额度降低机制根本没办法把astra当主力。有钱的另说了

  • iceberg01 09-23 12:19
    7

    确实失望,相当于没发布模型,就是给老模型打了个折

  • StarFox 楼主 09-23 12:19
    8

    这么说的话就有点无语了,不知道该怎么说才好了

  • jerry wu 09-23 12:19
    9

    他这个新模型表现和用量,只配被a畜疯狂吊打

  • StarFox 楼主 09-23 12:19
    10

    而且说实话,同样是 OpenAI 的不透明订阅额度的问题,我现在都很难很难相信 API 上面的价格半价是否适用于订阅。可能订阅名义上是跟 API 价格同步,但实际上额度很有可能都没增多少。

  • CrisR 09-23 12:21
    11

    确实,我看一些测试棒,6sol的成绩都是落后于5.6sol

  • StarFox 楼主 09-23 12:22
    12

    这就有点说不过去了。其实 6 SOL 相比较 5.6 SOL 的提升很小,就已经让人难以接受了,要是在相比较下降,就很难怀疑 OpenAI 的能力问题了

  • 快热的鸭皮 09-23 12:22
    13

    这个价格我觉得挺香的,定位很明确gpt6 Astra负责规划、审查、啃硬骨头,gpt6 Sol负责写代码、干苦力、能干我90%以上的活,gpt6 luna负责干简单的事情、自动化、高性价比。再加上Antigravity+3.8flash做前端,我感觉非常适合我,已经不用找国产来平替了。

    附带两个测试智力截图,比5.6sol明显好很多、尤其是5.6sol降智严重,性能够用的时候就应该考虑降低成本了。



  • runner dhero 09-23 12:22
    14

    我也没明白open ai冷不丁来一手转向性价比是何意味,就跟苹果公司突然宣布下一代手机要对标红米K系列一样让人摸不到头脑

  • Doro2077 09-23 12:22
    15

    ^-^6sol 是重新构建的吧,无论是前端效果和computer use都是6系列的,比5.6sol强太多了,现在梯度变了,Astra的定位才是顶级模型,相当于现在的次级模型有了以前旗舰模型的水平

  • StarFox 楼主 09-23 12:23
    16

    那要这么说的话倒也还行。我更倾向于认为 6 SOL 是将没降智过的 5.6 SOL 直接拉出来的。


    但是其实在之前 SOL 最大的痛点就是它的模型训练,它特别喜欢啰里吧嗦的、防御性开发和一些冗余的复杂的、没有用的测试,这就是它的模型能力整个被拖累。现在大家最期望的应该就是把它这层问题洗掉,让它会说人话,跟 Astra 一样简单直接一点、指哪打哪,哪怕是这样,我也是愿意的。


    反正这么看的话,SOL 绝对配不上 6 的头衔,顶多算是 5.7。

  • StarFox 楼主 09-23 12:24
    17

    我个人认为不大可能,因为总不能说 Astra 智力高,就不会防御性编程、不会说人话吧?这肯定大部分是由训练数据和模型基底所导致的问题。


    那么假设 GPT-6 系列整个都是重训练的,SOL 的 intelligence 可能不如 Astra,但它也不应该还有 5.6 的那些毛病,比如最让人诟病的防御性编程。

  • puppywang 09-23 12:24
    18

    看你干啥了,以我coding的用户来说,astra 和 5.6sol我体验区别不大,搞不定的还是搞不定,幻觉的还是幻觉,两者都远远不如 fable 的工程能力

  • StarFox 楼主 09-23 12:25
    19

    我测试的就是 CODING,因为之前 5.6 SOL 的 CODING 尤其是防御性的问题是最让人诟病的,我一上就先测的这个。别的我测试来说感觉中规中矩,基本上就是 5.6 直接照搬。

* 帖子来源Linux.do
返回