Qwen3.8-27B编程能力已赶上一线(二线)梯队。(来自aireleasetracker榜单)

996 2026-08-16 12:41 1

Qwen3.8-27B编程能力已赶上一线(二线)梯队。(来自aireleasetracker榜单 Qwen3.8-27B — Benchmarks, Specs & Release Date)


筛选展示以下两个coding的能力排行:


1、修复BUG能力:


人工智能能否修复实际软件中的真正漏洞?它需要处理来自开源项目的实际问题,并编写真正能够解决这些问题的代码。分数越高越好。



2、编码能力:


人工智能分析公司对深度自主软件工程工作进行了一项独立测试——人工智能必须能够规划并完成大量端到端的编码任务。




  • qwen3.8-27B是否真的赶上ops4.6 ?(你的使用感受)





  • 赶上并超过

  • 赶上了,差不多的水平

  • 没赶上

  • 我是打酱油的。






0
投票人



最新回复 (3)
  • 白学森 08-16 12:45
    1

    qwen的小模型agent能力一直很强,代码能力确实是可以打自己的上代Plus的。


    本地部署的话非常香,但是在执行多样问题上还是和大参数量模型有差距


    ————



    另外这个网站怎么感觉不是很靠谱啊,,ds是闭源的都来了

  • babu 08-16 12:45
    2

    跑分高确实有一定道理,但是小模型就不要强求做复杂的任务了,毕竟可靠性以及世界知识肯定不如大参数的,相信未来的发展能出现跑在手机等终端且可用性良好的模型 ^-^

  • 奶奶说过 08-16 13:30
    3

    居然打得过k2.7 code??


    如果租显卡部署自用的话是不是比较香^-^

* 帖子来源Linux.do
返回