GPT 6 Luna 这价格真的神了

street000 2026-09-23 09:11 1

5.6 Luna:
输入:0.25 美元/M
缓存输入:0.02 美元/M
输出:1.2 美元/M


6 Luna:
输入:0.125 美元/M
缓存输入:0.01 美元/M
输出:0.5 美元/M


输入降幅 50%,输出降幅 58%。


AAI Index 单任务价格和 Token 效率看上去也是遥遥领先同类模型。



要是奥特曼能让 TPS 再来个 50% 或者翻倍提升,感觉薅的 Gemini Flash 都没什么用的了。

最新回复 (41)
  • street000 楼主 09-23 09:21
    1
    立刻用一个 Free 号跑了一个不大不小的任务:

    整个代码库 9 万多行 Kotlin ,先让它读代码规划变动。后续还进行了三轮对话,一轮确认开始改动,一轮修改变量名,一轮修复一个 lint 报错。

    速度:
    从开始到结束大概不算等待确认时间大概五六分钟,速度感觉还可以。

    代码质量:
    改动 10 个文件,新增代码 120 行,除了一个行宽超过限制的 lint 错误没有编译报错。增加的代码符合预期,没有乱加注释,除了一个变量名不符合我的想法。

    Token 用量:
    没用各类面板统计,总 Token 消耗不清楚,上下文窗口占 182K / 258K ,感觉在意料之中,没有雷霆大思考。但 Free 号月额度下降 12%,额度消耗还是过大,API 50%的降价感觉没有完全反映到 Free 号额度上。看来用几个 Free 号来实现 Token 自由还是不可行,薅的 Gemini 感觉还是有用处的。
  • street000 楼主 09-23 09:27
    2
    思考强度:xhigh
  • snakejia 09-23 09:30
    3
    这个是 api 的价格吧
  • street000 楼主 09-23 09:36
    4
    @snakejia 是的
  • sweord 09-23 09:37
    5
    比较了 6 luna 和 5.6 luna 。6 luna 消耗快得多,跟 5.6 terra 差不多吧
  • street000 楼主 09-23 09:43
    6
    缺点:规划能力和意图理解似乎没有提升,复杂需求还是会错意理解。看来还是只能作为执行模型,要么人工审核它的计划要么让大点的模型来规划。
  • street000 楼主 09-23 09:46
    7
    @sweord 感觉 API 降价并没有反映到 Codex 用量消耗上
  • street000 楼主 09-23 10:10
    8
    体感性能没提升已经觉得没那么香了,看到 Flex Tier 一半的价格又感觉香了:

    输入:0.0625 美元/M

    缓存输入:0.005 美元/M

    输出:0.25 美元/M

    已经来到 Mimo Flash 和旧 DeepSeek Flash 的领域。

    试了在 OpenRouter 调 Flex Tier API ,目前首字延迟还能维持在 1.5s - 2.5s ,TPS 在 50 - 90 ,似乎和标准模式没区别。便宜 Token 时代好像又回来了。
  • test1199 09-23 10:20
    9
    这样大家就相当于流水线质检员了, 再过一段时间全自动了, 大家就都要失业了
  • jonty 09-23 10:31
    10
    神在哪,tps 低的要死。这个能力的模型就得图快,真不如 cline pass 的 ds4f
  • bghtyu 09-23 10:40
    11
    ChatGPT 订阅的额度是 API 价格的好多倍,换算下来 Luna 真的超级便宜。
  • oldManNewThought 09-23 10:58
    12
    我使用下来,感觉还是很省,不比 5.6-lunu 更多消耗,超省 token
  • street000 楼主 09-23 11:04
    13
    @jonty Codex Free 大概 40 tps ,慢一点不过能免费用,挂个 CPA 用来翻译总结之类很可以了。用 API 有 60-90 tps 感觉也够用了。
  • street000 楼主 09-23 11:07
    14
    @bghtyu 确实,现在最大的问题就是慢了
  • ntdll 09-23 11:07
    15
    很不幸的是,今天 web 上的 thinking 模型,已经弱智到流口水了。现在 5.4 mini 下线了,不知道是给路由到哪个小模型上了
  • dyikai 09-23 11:07
    16
    就 6 luna 这个价格,我为什么不用 DS 4.1🤣
  • Tolcol 09-23 11:12
    17
    降价了,也降智了
  • solost475 09-23 11:13
    18
    订阅计划的 gpt6luna 还没上吗?
  • dongzhimin 09-23 11:13
    19
    6 sol/luna 这跑分不就是 5.6 改名么
  • street000 楼主 09-23 11:16
    20
    @oldManNewThought 刚刚清空上面任务的对话看到输出 token 才 56k ,确实很省。让 Gemini Flash 来,只是规划可能都不止 56k 了。
  • street000 楼主 09-23 11:22
    21
    @solost475 应该有了吧,可能需要更新重启 Codex
  • street000 楼主 09-23 11:24
    22
    @dongzhimin 感觉就是了,体感上也没感觉有什么提升
  • JZen 09-23 11:33
    23
    订阅账户(非 API 用户)的用量是按 token 量给的,至于多少量看官方脸色,总之模型降价和订阅用户关系并不是很大。

    例如 5.6 sol 在降价前,pro 20x 可以用 2500 刀的周额度,降价 20%后,就只能用 2100 左右了。虽然降价了,但总用量没变化。

    还有很重要的一点是,每个模型给的量不同。

    例如仅用 5.6 sol 的情况下,pro 20x 可以用 2100 刀,但如果仅用 6 astra 的情况下,只能用 1500 刀左右。
  • yjiefl 09-23 11:37
    24
    6 luna 强还是 5.6 terra 强?
  • wish8023 09-23 11:46
    25
    @test1199 本来就是为 AI 服务的,或者说某种程度上把 AI 当做能力杠杆的。。。
  • jiayouzl 09-23 11:49
    26
    5.6 的 LUNA 弱智的很!不知道这 6 如何。
  • street000 楼主 09-23 11:52
    27
    @JZen 应该有 Token 倍率吧,免费账号体验下来 Luna 的消耗好像并没有变慢
  • xiaomushen 09-23 11:53
    28
    只能说,中规中矩
  • street000 楼主 09-23 11:55
    29
    @yjiefl 肯定是 terra 更强了
  • strobber16 09-23 12:43
    30
    修复了标价被小米吊打的 BUG
  • naythefirst01 09-23 12:55
    31
    测试下来还是 sol 有性价比,luna 智商有些低
  • idragonet 09-23 13:29
    32
    测试 6.0 luna 一如既往的慢,还是继续 FLASH 3.8.
  • cheng6563 09-23 13:51
    33
    我试着 luna 远不如哈基米
  • laowang0504 09-23 14:27
    34
    各方面不如 5.6sol
  • qxmqh 09-23 14:39
    35
    太慢了,我改一个小东西 时间太久了
  • yiranw09 09-23 15:03
    36
    中转那边 pro 号池的价格已经干到 6 毛钱一个亿了...
    除了慢,似乎已经几乎免费了
  • idragonet 09-23 15:22
    37
    @cheng6563 #33 太慢了!相同问题 luna 4 分钟,FLASH 3.8 1 分钟。
  • msg7086 09-23 15:35
    38
    @idragonet 哈基米是真的快,这个没办法的。但凡今天哈基米再聪明点,我就真天天用了。
  • gcgj72 09-23 15:44
    39
    @idragonet #37 luna 开 fast 感觉速度还可以啊
  • street000 楼主 09-23 15:49
    40
    @idragonet Gemini Flash 确实太快了,感觉它写完整文件覆盖改动比其它模型局部的改动还快。就是工具调用和 token 效率让人难以接受,一上来就是四五个 git 命令,代码还没看就先查几个提交日志,也不知道它要干嘛。等到终于规划好了,代码还没动就先全部跑一遍单元测试。一到 Kotlin 或者 Rust 项目用它太折磨了,必须要在 AGENTS.md 强行限制它才能好用一点。
  • street000 楼主 09-23 16:02
    41
    @yiranw09 可能请求已经比 Token 贵了,怪不得前段时间看到有人说很多中转站都下架 Luna 了
* 帖子来源V2EX
返回