摩尔线程宣布开源MusaCoder:首个国产全功能GPU全栈训练代码大模型

Bunn 2026-06-10 19:29 1

今日,摩尔线程宣布正式发布并开源MusaCoder,这是面向GPU底层算子生成的专用代码大模型。


摩尔线程表示,MusaCoder是业内首个基于国产GPU算力底座完成全链路训练与验证的开源代码大模型,其完整后训练流程均在基于MTT S5000构建的夸娥智算集群上完成。


据介绍,MusaCoder包含9B和27B两个参数规模,主要面向GPU底层算子生成任务设计,重点支持从PyTorch标准算子自动生成高性能CUDA/MUSA原生Kernel代码。


这一能力可降低开发者手写底层GPU算子的门槛,提升GPU高性能计算场景下的代码生成、验证和优化效率。


性能方面,在KernelBench评测中,MusaCoder-27B-RL取得Overall Pass@8 93.2%、Avg.@8 88.60%的成绩,超越Claude Opus 4.7、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6等主流SOTA代码模型,达到当前行业领先水平。


摩尔线程称,MusaCoder的SFT(监督微调)、RFT(拒绝采样微调)、RL(强化学习)、异步rollout、在线编译执行验证及reward计算等全栈训练与验证流程,均依托MTT S5000构建的夸娥智算集群完成。


这也意味着,国产GPU不仅能够支撑大模型推理和常规微调任务,也能够稳定承载代码大模型后训练全周期算力需求。


尤其是在GPU Kernel生成这类任务中,训练系统需要频繁进行代码生成、编译、执行、验证和反馈计算,对硬件、编译栈、运行时、调度系统和评测基础设施都提出了更高要求。


最新回复 (8)
  • 过期绿坝粮 06-10 19:36
    1

    泥开源我们就是朋友(


    所以在线API呢,让我测测



    MusaCoder-27B-RL取得Overall Pass@8 93.2%、Avg.@8 88.60%的成绩,超越Claude Opus 4.7、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6等主流SOTA代码模型,达到当前行业领先水平。



    这个模型应该跟各位没什么关系,它主要是专门用于写GPU底层代码的,27B能超过这些模型主要是因为针对性的强化学习


    盲猜会有营销号MusaCoder超越Claude(

  • unsafetrait 06-10 19:38
    2

    27B?我记得MINIMAX M2.7都270B吧?这。。。。挺好的,至少是个全国产模型,不过还是得看实际测试效果

  • 太期待丶 06-10 20:05
    3

    摩尔真有吹出来那么厉害吗。。。。 感觉我对摩尔不抱希望 起码要再等几年吧

  • 云馨 06-10 20:08
    4

    性能方面,在KernelBench评测中,MusaCoder-27B-RL取得Overall Pass@8 93.2%、Avg.@8 88.60%的成绩,超越Claude Opus 4.7、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6等主流SOTA代码模型,达到当前行业领先水平。



    我之前就思考过小模型特定方向。这个看起来就是小模型特定方向的例子。真的很棒欸,如果实际体验如榜单一样。我猜实际体验应该不差,像是摩尔线程Self-Evolution。至少有足够的GPU相关的语料

  • wwweagle 06-10 20:15
    5

    他就只干一个事就是把NV的CUDA翻译成MTT自己的MUSA。也行吧,四舍五入算兼容CUDA了。

  • sse 06-10 20:31
    6

    这也需要大模型 ^-^ 为什么不做个“编译器”呢

  • xie reens 06-10 20:41
    7

    666,还是得卖铲子才行,官方直接下场做大模型

  • 🌟𝗦̘̚𝘂̘̚𝗽̘̚𝗲̘̚𝗿̘̚𝗻̘̚𝗼̘̚𝘃̘̚𝗮̘̚ 06-10 20:42
    8

    性能方面,在KernelBench评测中,MusaCoder-27B-RL取得Overall Pass@8 93.2%、Avg.@8 88.60%的成绩,超越Claude Opus 4.7、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6等主流SOTA代码模型,达到当前行业领先水平。



    不是,我看看不懂中文了吗?这还是2026年吗?

* 帖子来源Linux.do
返回