我也认同 Astra 最近的事故,最近 openai 最大的问题是算力不够

LPluto 2026-09-18 12:00 1

转载自X:@xudaoai


梳理了一下 Astra 最近的事故,最近 openai 最大的问题是算力不够。


Astra 的 serving capacity 跟不上现在的需求。Astra 上线前,Codex 就已经有 Model is at capacity。当时中文圈很多人怀疑是中转站、共享账号,甚至中文用户被特殊处理。我自己也想过这个可能,但我的情况其实不太符合:人在澳洲,澳洲 IP、澳洲支付,正常个人订阅,平时不用中转。后来再去翻公开记录,发现美国正常 Pro 20X 用户在 Astra 上线前也遇到过同样的问题,所以 Capacity 不能只往中转站整治上解释。


9 月 3 日 Astra 上线后,问题很快密集起来。先是大量用户抱怨额度掉得特别快;9 月 6 日,Tibo 就调整了重度用户的 usage accounting,部分 long-tail workload 最高能少扣 3–4 倍额度,而且他说质量不变;9 月 7 日又来一次 Global Reset。接着 9 月 7、8 日,Model is at capacity 大量出现,这次本地日志里直接写着 server_overloaded,同时 used_percent: 0.0、rate_limit_reached_type: null。至少这些案例里,不是用户没额度,而是服务端过载。


9 月 9 日,Tibo 自己说 Astra 的需求是 “really unprecedented”,以前也经历过很陡的增长,但没见过这次这么夸张。第二天,OpenAI 直接暂停新的 $200 Pro 20X 注册和升级。Tibo 说这些用户 “put the most strain on our systems”,然后又说 “we are working on adding more capacity as fast as we can.” 到这里,“算力不够”已经不太像一个激进猜测了。


而且还漏了一个很大的变量:API 和企业客户也在抢 Astra。OpenRouter 的数据里,截至 9 月 7 日那一周,OpenAI 模型在 OpenRouter 上的消费第一次超过 Anthropic,上一次还是 2024 年 2 月;Astra 自己就拿走了 OpenAI + Anthropic 两家合计钱包份额大约 19%。这当然只是 OpenRouter,不代表整个市场。Ramp 的企业数据也出现了类似变化,Astra 当周约占它追踪的企业 AI 支出 13%。两边放在一起看,至少能确认一件事:Astra 上线后,API 和企业侧的付费需求涨得很快。


再看 OpenAI 自己的商业产品,差别就更明显。企业 API 可以买 Reserved Tier,提前锁 provisioned capacity,高峰期也保证可用;还有 Fast / Scale Tier,花更多钱换更稳定、更快的处理。Business Premium 的 Work / Codex 用量也比 Standard 高很多,用完还能继续买 credits。反过来看个人订阅,Plus / Pro 是固定月费,OpenAI 可以用额度窗口、周限额、fallback、Model is at capacity,甚至暂停 20X 新用户来控负载。


OpenAI 没公开过“API > Enterprise > Pro > Plus”这种内部优先级,但如果 Astra 的供给短期真的不够,已经预购容量、有 SLA、按量持续付费的 API 和企业客户,显然比固定月费消费者更难随便压。


Codex 又把这个问题放大了。普通 Chat 很多时候只是问一句、推理、回答;Codex 却是读 repo、reasoning、shell、改代码、test、retry、child agent、review,再把一大坨 context 继续喂回去。Chat 是问 Astra 一个问题,Codex 是让 Astra 连续上班。


然后我们就看到了现在这些问题:额度掉得飞快、Model is at capacity、server_overloaded、任务做几分钟就停下来、不断让你“继续”、20X 停卖、达到限额后 fallback,有些账户甚至直接看不到 Astra。


中文用户这边更乱一些。有人连普通中文“你好”都会被 Astra 判成 invalid prompt;有 Plus 用户之前能正常用 Astra,后来模型直接从 Codex 选择器里消失;还有用户拿同一个中文任务做前后对比,capacity throttling 前后,reasoning token、output token 和结果质量都出现了明显变化。


9 月 12 日 OpenAI 确认过的质量问题本身也是真的:Context Management 会导致 early stop,约影响 4,000–5,000 人;旧 Skills 会干扰模型完成任务;还有一批配置错误的 inference engines,确实造成了 measurable quality degradation。这些问题不能直接归到算力头上,但它们和额度、Capacity、20X 停卖,几乎都挤在同一个时间段。


所以把整条线串起来:Astra 本身更贵,Codex 又是重型 Agent workload,Plus 用户也能大量接入,API 和企业需求同时暴涨,企业还能花钱锁容量;然后 usage 上线几天就大改,连续 Reset,server_overloaded,Tibo 说需求 unprecedented,$200 Pro 20X 停卖,OpenAI 公开说正在拼命增加 capacity。

最新回复 (6)
  • 光年 09-18 12:00
    1

    特别难用

  • 西楼 09-18 12:22
    2

    完全不可用,今天恢复了一些

  • Rowan8 09-18 13:18
    3

    用的人太多了

  • dtybgg 09-18 13:21
    4

    AI味

  • 云端网 09-18 14:18
    5

    虽然你说对了, 但是可以不要让AI输出这么多文字么,真的阅读不下去 ^-^

  • nec 09-18 14:21
    6

    求求了,本质上几句话就说完的事,为什么要让 ai 不停的来回重复车轱辘话输出这么几千字 ^-^

* 帖子来源NodeSeek
返回