现在文笔最好的大模型是哪个啊?

wox 2026-07-30 21:53 1

写文章,聊天的场景下。

感觉gpt有时候都听不懂人话。。

最新回复 (19)
  • ninee 07-30 21:54
    1

    毫无疑问,首选还是Claude,次选deepseek

  • lol 07-30 21:58
    2

    這個我經常用,

    claude,最像普通人類,不浮夸,但是用多了還是感覺 AI 味最重。

    gpt, 最像老學究,其實我感覺好多佬說的偽人感沒有那麼強。

    哈基米, 舔狗

    glm,無感

    deepseek, 很多佬說很好,但是我感覺像 gpt 和哈基米的中間檔^-^

  • Bluedot 07-30 22:01
    3

    我用最直接、最不绕弯子、最扎心、最硬核、最干脆、最不墨迹、最戳痛点、最不留情面、最一针见血、最开门见山、最单刀直入的结论告诉你,是豆包

  • wox 楼主 07-30 22:02
    4

    感觉现在大模型都专注代码,有时候很简单的话都会理解错。。

    还记得4o和0325。。。

  • kakarot8 07-30 22:02
    5

    claude 4.6对比下来是不错的,gemini太容易放飞自我了

  • Springsun21 07-30 22:03
    6

    中文最好claude吧,国产模型deepseek,GLM5.2等都可以呀。

  • BlueSkyXN 07-30 22:03
    7

    首先排除gpt,完全不人话,最垃圾

  • 捡起西瓜 07-30 22:04
    8

    好多人都在夸Claude opus 4.6,不过我现在用的网页版GPT觉得也还行。

  • jaridli 07-30 22:05
    9

    感觉gpt生成的文章都是在不断的重复一些内容

  • AAAAAAAAAAAA 07-30 22:05
    10

    文笔这方面,kimi k3、claude opus 4.6、glm 5.1、5.2都不错。如果是大批量写文的话,在结构鱼骨很清晰,模型只需要写正文的情况下,可以尝试GPT-oss,一种GPT 4o的味道,也不错。




    其实GPT 5.5、5.6sol在文笔方面的提升已经是巨大了,之前的5.x几乎不说人话^-^

  • solisolis 07-30 22:05
    11

    文笔好的话可能还是opus4.6了,最新的5不清楚怎么样,好像还没看到评测文笔的。反正4.8说是各种不说人话

  • kakarot8 07-30 22:05
    12

    听说K3也是不错的,我这会也在尝试

  • 00:00 07-30 22:06
    13

    有钱上opus4.6,国模glm5.1学到了opus4.6的部分精髓,调一调关键词也非常好

  • 神话大萝 07-30 22:07
    14

    主流模型逐渐开始强化 coding ,而不说人话。—不要看旗舰模型版本号往上叠,其实论写文章真不一定比得上旧版本



    • 虽然谁写得好聊天好很主观,但是比较公认的还就写文章和聊天而言,我觉得还真不要死看版本号和旗舰模型。–虽然大家莫名会有一种主观的下意识就认为,就是说那些最旗舰的,尤其是跟 AI 相关的,或者一些国产模型写文章就一定会好。


    (好比 glm-5.2 写文章大多数人认为还不如 glm-5.1 或者更旧的 glm-4.7 ,


    再比如谷歌陨落的 kingfall 和 OpenAI 的 gpt-4.5 ,现在的主流旗舰就看写文章和聊天可能真的打不过。。)




    就论写文章和聊天,我倒是觉得谷歌开源的 gemma-4-31b-it 其实真的不错。 开源的,而且本身几乎没有道德甲。(当然,仅用来写文章和聊天哈,在这个方面的能力真的不逊于绝大多数的我们所谓的旗舰热门模型了. 不过,拿来干其他事情,比如说 AI coding 它就是废物。).


    而且这个本地就可以部署,就算不想本地部署,第三方云平台可以免费用的也一抓一大把,免费额度慷慨到爆。还有速度超快的一些平台,700~800 Tokens 每秒的都可以达到,用起来也很爽。无论是日常写文章,还是上酒馆。




    如果需要更强,还得实践体验比一下吧。比如说把 gpt-4.5 (注意,是超级昂贵的 gpt-4.5 ,不是 grok-4.5 哦。), fable-5 , claude-opus-4-6 , kimi-k3 , claude-opus-4.1 这些大家可能凭感觉和体验公认的 文本比较好的模型来碰一碰,并且让一部分人包括普通人和专家来进行评价

  • 捡起西瓜 07-30 22:09
    15

    ,最新的5不清楚怎么样,好像还没看到评测文笔的。反正



    我自己目前是国内同步用qwen3.8、kimi2.6、DeepSeekV4Flash、GLM5.2,都是网页端,因为我自己主要是日常聊天、信息查询和确认(包括工程类、计算机使用、医疗等),感觉最次的就是GLM5.2了^-^ ^-^不是很满意,无论是回答的内容还是语气,都不够趁我心意。qwen3.8和kimi2.6算是互有胜负,DeepSeek偶有佳句,这仨差别不是太大。

  • crazycrazyshui 07-30 22:09
    16

    毫无疑问是a÷家的模型,他家模型真是在这遥遥领先,如果是在coding领域,5.6和K3已经逼近了fable,但是文本这一块,claude就是毫无疑问的垄断地位,很难想象a÷是怎么做到coding和text兼容的

  • ixiaotian 07-30 22:10
    17

    K3吧,国内最强呀,训练数据那么多

  • 00:00 07-30 22:12
    18

    所以说是glm5.1不是5.2,5.2是面向编码优化的 ^-^

  • wox 楼主 07-30 22:13
    19

    我之前看a/的播客,他们还是很相信scaling laws的,模型参数应该很大

* 帖子来源Linux.do
返回