说实话,有些任务,可能还是国产模型更加适合

thehuan 2026-09-27 02:34 1

为了减轻信息茧房,我给hermes配了一个每天一次的信息汇总,但那份汇总报告也挺长的,我额外要求发给我信息时先给我最高最不应该错过的五条

然后就彻底错过了刘欢老师的新闻,我都是出去玩听朋友说起才知道,震惊


今晚我又试了下,把这份简报发给各大模型,需求就一个:从这里面你选5条你认为讨论度最高最不应该错过的

新闻简报_2026-09-27.md (17.8 KB)

(这份简报也是ai生成的,刘欢老师的新闻隐藏在其中小小的一条里面)


国外模型都不是很看重刘欢逝世的新闻

这是GPT web版的:




总结



这是grok web版:




总结



gemini则能够注意到:




总结



而换成国内的,基本都能注意到并排到前五条中

豆包2.1 Pro、Qwen3.8-Max甚至会排第一或第二




总结




deepseek则比较特别,不会排进前五条,但会额外单独加一条




总结



测了一圈国产的目前没发现漏掉的,即使是qwen3.8 27b都不会漏掉。不过觉得特别重要的也不多,就豆包2.1 Pro、Qwen3.8-Max排的很高


我觉得这也符合我对国内大模型的感知,知识面越广的越面向大众的越能认识到这条新闻的重要性,gemini也证明了这一点。


别给我说什么我提示词没弄好,这种例子本就是小概率事件,我不可能事先就定出完美的提示词,总的来说,处理中文资讯,还是用国产模型才是正解。

最新回复 (3)
  • 一只猪 09-27 02:41
    1楼





    GPT开超高也可以给出来

  • 时牧 09-27 02:41
    2楼

    感觉这种可以直接抓取社媒热搜,会比较符合国内用户关注的热点

  • DFobainx 09-27 03:04
    3楼

    国内模型做消息汇总不好的一点是有些内容会被拦截。


* 帖子来源Linux.do
返回