请教vibe coding大佬

Terrywap 2026-08-06 10:44 1

用的codex,看到别人对GPT的“IQ”监控( https://codexradar.com/#model-ratings ),有三个问题想请教一下:

1、选择模型的时候,是不是只要IQ接近直接选最便宜的?例如我的任务之前一直用sol high,但是看了评测后发现IQ还不如luna max而且后者还更便宜,那我是不是可以直接换成luna max呢?

2、价高而IQ低的选项存在的意义是什么?例如sol low的IQ还比不上terra xhigh,但是后者能便宜20%,那为什么openai还要发布sol low?

3、除了所谓的“IQ”,是不是还有其他指标评价模型?

最新回复 (11)
  • LionKing 08-06 10:44
    1

    不用这么废话,无脑luna max

  • WithZeng 08-06 10:45
    2

    不要看所谓的iq值 你实际开发才会知道每个模型的能力 我建议无脑用sol就行

  • akisui 08-06 10:46
    3

    这些只是参考,我反正是设计方案用sol max,然后执行用 luna max或者 terra

  • sa 08-06 10:50
    4

    luna max非常慢,实际水平并没有比sol high高

  • Edwin999 08-06 10:52
    5

    luna max就是无脑,又慢又干不了活,老实用sol ^-^

  • sherowei 08-06 10:54
    6

    1楼和2楼先打一架

  • Terrywap 楼主 08-06 10:57
    7

    怎么感觉这东西公说公有理婆说婆有理了 ^-^

    按道理应该是有个标准答案吧

  • 1952444901 08-06 11:15
    8

    当然没有标准答案,目前所有的跑分、评测,对用户侧来说都是黑箱,没人知道模型做了哪些特挑优化。大部分降智监控是按单纯的做题来实测的,这个更是参考价值堪忧。

  • 1952444901 08-06 11:16
    9

    实际上只能根据自己的环境、自己的项目、自己的习惯,用实测体验做对比。

  • yuzuki-zzZ 08-06 11:20
    10

    雷达只是参考,还是要看实际效果。我一般处理复杂任务都会用sol-xhigh,简单一点的会切到sol-medium或者terra-high

    并且执行时间也是一个很重要的指标,比如luna max你看它分很高,但是他和sol-medium得分相同的情况下慢一倍。很多时候我会故意用sol-medium而不是xhigh来得到更快的回复。

  • kaming 08-06 11:28
    11

    luna 省下的 sol 还是得修了花出去 当然比较简单的任务除外

* 帖子来源NodeSeek
返回