一个简单的搜索小测试,没想到国模全军覆没

天怒 2026-10-01 02:13 1

搜索一下社区经验,写生图提示词,什么模型最适合,我用gpt6astra感觉效果很一般。




ds,行,我不怪你,你不思考+搜索弱

给10分吧






千问你何意味,没听过是吧

0分抬走






3.8max,给的推荐更现代一点,20分吧






hy4,好像回答了,但是完全错的。40分吧






gemini3.8flash,意料之外的好,但是推荐的有点老,明明我说的是26年模型,但是还是推荐了上古模型

70分吧






gpt5.6sol

你大爷还是你大爷,chat体验无出其右,100分






kimik3,emmm为何呢






豆包2.1prohigh,agent搜索我还一直觉得豆包不错,没想到拉完了,不想给分了。

最新回复 (6)
  • nclp 10-01 02:17
    1楼

    我用gemini也是经常给我推荐上古模型

  • 与君小叙 10-01 02:19
    2楼

    不错的小测试,很明显能感觉出来各个模型理解能力和搜索能力的差距。Gemini我感觉是后训练问题,一直是更依赖知识库,理解和智商还是有但总是假装搜索实际还是用老知识回答。。。

  • 天怒 楼主 10-01 02:19
    3楼

    能不搜索,绝对不多搜索一下。非必要不搜索

  • scp3500 10-01 08:15
    4楼

    佬觉得这个怎么样

  • 天怒 楼主 10-01 08:19
    5楼

    85吧,答出来了,给的答案也不错。但是也马马虎虎的。

    比如“ChatGPT/Grok>本地Qwen(批量用)。GPT-6Astra基本不在这个名单里”

  • scp3500 10-01 08:20
    6楼

    这个是deepseek外接了tavily搜索

* 帖子来源Linux.do
返回