感觉gpt确实强,gemini真的拉完了

rainice 2026-06-27 12:39 1

心血来潮,刷到关于韩国队可能晋级不了的消息,但是刷小红书偶尔看到12个第三名里韩国队排第七,感觉机会挺大的,就很疑惑为什么这么多人说韩国很难晋级


我以前没看过足球,完全不懂规则,所以就去问了ai


我日常用的是千问,但是千问回答的有点错误

我就觉得千问很垃圾,然后试了一下deepseek,发现deepseek更垃圾


此时觉得国内ai都不行,还得是国外ai


然后问了cahtgpt,发现chatgpt还不如千问,最后刷知乎看到有人在吹gemini的搜索,觉得gemini做这种事情应该更擅长,但是试了一下发现gemini还不如gpt,更不如千问。。。


提示词:韩国出线形势如何?


千问(3.7 开思考模式)回答:



基本正确


deepseek:





测试时(6月27号12点半 仅剩余4组没有打完 deepseek最基本的都回答错了)


豆包:




gemini:





。。。H组已经打完了,gemini连搜索信息这块都拉了,感觉不如豆包


chatgpt:



由于网络问题,gpt回答的时候已经到12点了,而且页面更新了一次,不知道是不是升级成gpt5.6了

但是确实是实时性最强的,连正在踢的比赛的数据都找到了

最新回复 (10)
  • rainice 楼主 06-27 12:41
    1楼

    由于写这个帖子的时间太长,前面的那段话有点问题,第一次测试的时候gpt不太行,但是后面升级之后就很强了。。


    ai的每次回答都不太一样,但是gemini和deepseek是多次回答错误的选手

  • rainice 楼主 06-27 12:42
    2楼

    但是帖子发出去之后就不能编辑了。。。改不了了

  • rainice 楼主 06-27 12:50
    3楼



    又测试了一次豆包,发现居然也出现那种还有几组没踢完都说不对的问题了


    难道是后台有额度限制?偷偷降智了?


    还是说是因为大模型的回答随机性

  • rainice 楼主 06-27 12:55
    4楼

    千问换成千问max之后也出问题了






    直接给我来了个厄瓜多尔6分


    虽然不太懂足球,但是6分很难第三啊,去查了一下实时信息,果然是千问出错了

  • 一颗冷凌檬 06-27 12:57
    5楼

    此时一个gemini头像的佬友正在输入文本(滑稽

  • rainice 楼主 06-27 13:00
    6楼



    gpt也有点问题,G组马上打完了,对韩国是否晋级影响很大,但是gpt没有说,直接忽略了,没有像上一次那样抓取到最新消息


    只能说大模型回答的随机性太强了

  • 𝔸𝔼𝕍𝔸 06-27 13:10
    7楼

    gemini 现在只用 deep research,反正能白嫖 token 何乐而不为呢 ^-^




  • rainice 楼主 06-27 13:12
    8楼

    这个也不行啊,H、I两个组早就打完了,报告里还说看这两组的结果。。。

    gemini怎么在搜索方面这么垃圾,这不应该是google的强项吗

  • Greem 06-27 13:16
    9楼

    佬友,看下这个答案对不对?


  • 𝔸𝔼𝕍𝔸 06-27 13:17
    10楼

    额你看串了吧,后面全是在说废话前面已经给了结论了,你 prompt 这么少他说废话那不就是随他发挥了

* 帖子来源Linux.do
返回