核弹来袭!OpenAI的自研推理芯片Jalapeño实现对GB300的全方面超越

fotxitek 2026-08-26 00:56 1

核弹级消息!OpenAI首款自研推理芯片Jalapeño直接吊打Nvidia GB200/GB300!


OpenAI刚刚公布自研芯片首批InferenceX基准实测结果:


🔸效率碾压:在GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 三个1T级开源模型上,峰值吞吐量每瓦特工作量提升1.5–1.9倍

🔸延迟暴降:端到端延迟降低1.7–3.6倍,高交互工作负载性能更高达2.1–4.1倍

🔸功耗惊喜:额定700W,实测工作负载稳定≤550W,远比Nvidia算力卡更省电

🔸部署时间表:2026年底开始小规模部署,Gen2已深度开发,Gen3正在成形

🔸战略意义:专注推理(非训练),减少对Nvidia依赖,全栈优势让未来模型更快更便宜更可扩展


总结Jalapeño 对 GB200:峰值 AI 推理吞吐/功耗大约提升 90%;极低延迟场景下单用户生成速度提升 173%。

Jalapeño对比GB300在高并发峰值吞吐/瓦方面优势提升约 50%~90%,在Agent、Coding Agent 这种追求低 TBT、连续生成的场景,提升约 2.7~4.1 倍的单用户推理速度,Jalapeño 对 GB300:峰值推理能效约提升 50%-70%,极低延迟单用户生成速度提升约280%~315%。


推理成本要崩了,750 token/s可能很快成标配。


https://openai.com/index/jalapeno-first-results/

最新回复 (5)
  • 野原新之助 08-26 00:57
    1

    nb

  • nodeseeek 08-26 01:04
    2

    那sol或者luna呢

  • 主机资讯 08-26 01:42
    3

    才550w?给我电脑装一个

  • LogicNova 08-26 07:57
    4

    先等量产再说吧

  • 落雪 08-26 08:21
    5

    ^-^ 瘫坐在椅子上 犹如核弹爆炸

* 帖子来源NodeSeek
返回