做了一个九厂 AI 模型横评,选完模型还能继续比渠道价格

hd264 2026-09-04 15:56 1

现在选 AI API 往往有两个不同的问题:先决定用哪家当前最强的模型,再决定从官方、云厂商还是聚合平台调用它。把同系列旧版本全摆在一起,信息很多,但对实际选型帮助不大。


所以我把页面改成两层:第一层每家只放一个当前可购买的通用领先模型,覆盖 OpenAI 、Anthropic 、Google 、xAI 、DeepSeek 、GLM 、Kimi 、Qwen 和 MiniMax ;第二层进入精确模型后,再比较它的全部 API 渠道。


目前底层数据快照包含:



  • 343 个有价格的模型;

  • 479 个当前可用渠道;

  • 21 家提供商。


今天 OpenAI 已经发布 GPT-6 Astra ,并将它称为当前最强模型;不过官方文档同时说明,普通 API 和订阅方案要在未来几天才开放。所以页面会显示这条发布状态,但在确认到实际可用渠道前,OpenAI 行暂时保留 GPT-5.6 Sol ,不把“已经发布”写成“现在可买”。


领先模型的选择规则是:



  1. 每家厂商只保留当前可买到的通用模型;

  2. 有 Agent Arena 分数时优先按分数选择,没有时才按发布时间;

  3. 不把“刚发布”自动等同于“最强”,例如当前数据中 Grok 4.6 更新,但 Grok 4.5 的 Agent 分数更高;

  4. 选定模型后再对齐精确模型 ID 比渠道,不混入旧版本;

  5. 保留渠道原始结算币种,只在跨渠道排序时换算美元。


页面在这里:


https://aiplans.dev/zh/compare/models?utm_source=v2ex&utm_medium=community&utm_campaign=model_selection_2026_09&utm_content=vendor_leaders


项目和数据处理逻辑是开源的: https://github.com/x2v-co/aiplans


我是这个项目的维护者。这次更想收集下面几类反馈:



  • “每厂一个代表模型”的规则是否符合你实际选 API 的方式?

  • 哪家当前代表模型选错了,为什么?

  • 哪些模型别名被错误地合并或拆开了?

  • 国内渠道的币种、地区或支付限制有没有漏记?

  • 缓存和 Batch 价格应该怎样展示才不容易误导?

  • 哪些渠道已经下线,或者价格明显过期?


如果发现问题,最好附官方定价页或文档链接,我会按来源重新核验。

最新回复 (0)
    没有回复
* 帖子来源V2EX
返回