英伟达 Nemotron-3-Ultra-550B-A55B 正式开源发布 1M上下文 免费上线

fengchris 2026-06-04 21:52 1



目前已经上线openrouter(nvidia/nemotron-3-ultra-550b-a55b:free)和build.nvidia.com


权重:nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 · Hugging Face

最新回复 (13)
  • 栏杆拍遍 06-04 22:07
    2

    看这个bench好像被两个月前的kimi k2.6秒了

  • fengchris 楼主 06-04 22:11
    3

    对比下确实没什么优势


    测试了一下效果也一般

  • 路人A 06-04 22:11
    4

    Ultra就只有550B,那1T以上模型怎么办,Ultra Pro吗

  • fengchris 楼主 06-04 22:18
    5

    可能就不往上继续做了么

    英伟达搞这个估计也不是为了跟其他大模型公司竞争 纯粹是秀肌肉 开源加分

  • smell 06-04 22:28
    6

    不是不想用,拿来翻译啥的也是不错的。但是英伟达那个网站太慢了…… 吐字也慢。他自己也缺算力么??

  • sxjeru 06-04 22:32
    7

    官方评测报告如图。模型大小为 550B-A55B.


  • 栏杆拍遍 06-04 23:09
    8

    有更大的,老黄说过,估计还没训练好

  • 阿达姆 06-04 23:16
    9

    看上去在绝大多数方面都比不过只有它一半大小的dsv4 flash呢…只能说老黄这模型还得多炼炼吧

  • sparklydream 06-04 23:18
    10

    现在模型打 IOI 这么强吗,吓哭了

  • 啁啾 06-04 23:40
    11

    激活参数量 55B,吞吐速度比 17B 的 qwen 还要高,怎么做到的

  • garma 06-04 23:44
    12

    老黄到也实在,基本都是垫底的位置

  • fengchris 楼主 06-05 00:11
    13

    Mamba-2+MOE架构+MTP技术

  • 宋帝 06-06 13:26
    14



    测试了,好像还强过5.4-mini,

* 帖子来源Linux.do
返回