互联网大厂鏖战AI办公入口,千问办公登顶

好好吃飯 2026-08-21 08:59 1

互联网大厂鏖战AI办公入口 华尔街实测排名:千问办公凭Harness得分登顶 _ 东方财富网

——————————————————————

近日,华尔街投行杰富瑞的一份AI Agent实测报告在业内引发关注。报告对八款中美主流AI Agent进行了五项真实办公任务测试,覆盖多文件检索、联网研究、浏览器操作、PPT制作及多模态内容生成等场景。


结果显示,阿里千问办公以95分综合排名第一,Anthropic的Claude Cowork以94分位列第二,OpenAI的Codex以92分排第三。



图片来源:杰富瑞研报


千问办公是唯一一个在所有测评维度中均获得90分以上的AI Agent产品,不过其底层模型Qwen 3.8 Max在模型智能的得分上并非第一,低于Claude Opus 5、GPT-5.6 Sol。杰富瑞由此提出一个反直觉的结论——Agent能力表现与模型智能之间,并没有想象的那么强相关。不是说模型智能不重要,模型智能关乎平均表现,但当把重点聚焦AI Agent好不好用时,Harness做得足够好,能够弥补模型智能上的差距。

最新回复 (1)
  • 蓬瑜砚 08-21 11:42
    1

    做ppt还是先用豆包,比其他work要好一点。

* 帖子来源Linux.do
返回