美国豆包?Google家的Gemini网页端官网 对比 AI Studio 看看Gemini降智的导火线源头

deepcake 2026-05-26 14:47 1

前言


众所周知Gemini目前被称之为美国豆包

而这一切的源头几乎都来自于网页端官网降本+降智导致的问题

隔壁的Ai Studio也是网页端,但智力比官网高许多,几乎是满血版


因此Gemini网页端官网降智 != Gemini模型降智

具体表现为思考强度低、不主动调用搜索

尽量能用Ai Studio就别用官网。远离降智官网,拥抱满血Ai Studio

且调API也是满血


如果真要用官网就得把提示词写更完善,例如提示词包含"搜索"、搜索时间等




官方说法


Ai Studio面向开发者,所以思考强度更高(满血),

而Gemini 应用面向消费者,再延迟、成本、智能方面平衡(降智)


虽然是这样说,但我怎么感觉逻辑不太对呢?普通人对于AI给的信息更加无法分辨是否正确,不应该也是满血的吗?


被称为美国豆包的原因之一有一部分也是自己造成的





案例一


不调搜索,不知道自家的新模型




[image]
Gemini网页新UI挺好看的,但是自家出了啥模型咋自己都不知道?


Ai Studio效果(正确搜索)





案例二


不调搜索胡言乱语,说不出图片的内容跟"梦幻魔法公主"有关



Ai Studio效果(正确搜索)





案例三


非常严重的谄媚,只要抠问号就会触发谄媚,驳斥自己上一轮对话中的说法




[image]
gemin也这么拉吗?


Ai Studio效果(正确,不附和而是再次调用搜索确认)





案例四


谄媚附和用户,说300+140=460是对的,被"对吗"?给引导




今天看到有个贴子向gemini新模型问这个问题,并且得到了错误的回答,怀疑是降智了,老实说我觉得应该不能说是模型本身降智了,而是模型的服从和认同以及省tokens策略被谷歌调的贼高。
如图
[图片]
[微信图片2026052218002676288]
这里可以看出,并非模型不能算出正确答案,而是模型有很强的意愿去同意用户的问题,甚至完全不看问题本身,明明是一个看一眼就绝对能做出来的题目,…


Ai Studio(正确)





案例五


不调用搜索,直接说"qwen 3.6"这个模型不存在




测试内容
众所周知,huggingface的命令行下载开头最近发生了修改。由之前的huggingface-cli变成了hf。而最新版的huggingface cli是不兼容旧的下载命令的。所以如果答案是huggingface-cli开头的必然运行报错(除非你是去年10月份之前的旧版本)
问题:给出我huggingface的qwen3.6 35b a3b Q4 gguf量化版本的最新下载命令
结…


Ai Studio(半正确)


虽不如GPT5.5的搜索效果,但跟Grok、Claude坐一桌

不过触发搜索说出"qwen 3.6"模型存在是百分百能做到的,网页端由于降智没有触发搜索,才说模型不存在


而关于"cli已被舍弃"一事概率性能对,能跟GPT5.5一致说cli已被舍弃(可能是搜索的索引已经更新了,才能正常搜到)





案例六


不主动调搜索,直接使用模型本身知识库中的知识进行回应,而本身知识库截止到2025年,因此该信息放到2026年已经过时,导致出现"幻觉"




使用哈基米网页版搜索文献感觉很好用,很少遇到参考文献是假的,所以我在claude code中做了一个哈基米的子代理方便搜索文献,几个月下来感觉体验不错。今天用着用着发现几篇论文内容感觉不对劲,网页版再试试搜索,真不对劲了,链接都是假的,不知佬友们有么有相同的情况 ^-^
[image]
[image]


Ai Studio(正确,没有幻觉)





官网提示词貌似被扒出


其中包含了:

“真诚地认可用户的感受,同时温和而直接地纠正重大错误信息”

“如果用户表达困惑,在纠正之前先予以认可”


这也可能是导致网页端谄媚比Ai Studio更严重的来源?


https://linux.do/t/topic/2221173


最新回复 (19)
  • 白芸汐 05-26 15:01
    1

    对于大部分人来说会用web端的模型就不错了,你这要他们分得清火山的模型和豆包有什么区别,为什么火山有那么多豆包的模型那真是难于上青天 ^-^

  • Jeff Dean 05-26 15:04
    2

    网页版用的人多,为了降本增效这样干的,而且那个系统提示词还会和指令里加的对着干

  • deepcake 楼主 05-26 15:05
    3

    是这样的,只能让谷歌把Gemini网页端把智力还回来跟AiStudio一样,不然容易误导用户,


    网页端大多数都是普通用户,更加无法分辨AI回应是否正确,也不知道网页端降智,需要有类似"搜索"的关键字才能调搜索

  • sanden 05-26 15:06
    4

    网页端是给本土阿美丽卡人用的,本地阿美丽卡能输入聊天都算天才了,你觉得谷歌会像这里倾斜资源?

  • 2 05-26 15:08
    5

    这个?Gemini网页版自用提示词第三版,插件推荐以及各渠道降智测试 - #30,来自 WvRt

  • deepcake 楼主 05-26 15:13
    6

    Gemini捞针成绩挺一般的,包比不过GPT5.5、Opus4.6这两大哥,没怎么测过


    我都直接看这个榜


    Leaderboard – Context Arena

  • sanden 05-26 17:32
    7

    快乐教育的产物会开关机就已经是天才了,很难理解吗?会开关机的天才,需要高深的资源吗?只要哄宝宝就可以了

  • jianyanggggg 05-28 21:43
    8

    之前一直用Gemini的gem和笔记本,最近开始抽风了,一直答非所问,翻出不知道什么时候的陈年记忆开始一通输出

  • Hifumi Mizuhara 05-28 21:45
    9

    支持支持。本来也想写一篇类似的文章。

    话说网页版到底为啥要装糖阴别人,这很诡异好吗

  • Jungle_Wood_547 05-28 21:55
    10

    美国豆包没绷住

    那我这周末DDL的实验怎么办 ^-^希望pro还安好(

  • Hifumi Mizuhara 05-28 21:58
    11

    不要用网页版的就好,用Aistudio和Antigravity的都是满血

  • 冬马99 05-28 22:05
    12

    所谓双头食人魔嘛。很好理解。其实,网页版、APP版的豆包也是这样,上下文也是看的只有很少的三四k。

  • Hifumi Mizuhara 05-28 22:07
    13

    我去,我突然觉得你说的这个思路很有道理

    结合最近我在X上刷到的各种弱智数学问题

  • lanvent 05-28 22:09
    14

    对于找片来说,gemini是否是top1?比如按照片找人,朋友没用过太多搜索类的网页模型让我帮忙问问 ^-^

  • Kinney Lorraine 05-28 22:11
    15

    找片还是grok和google的AI模式,gemini网页版没有网络搜索开关,有时候是关得-的

  • Kinney Lorraine 05-28 22:13
    16

    gemini app的智力分配都比网页版高,比如之前那个340+140=460的题目,网页版不开思考做不对,app可以做对

  • 莱特昂斯戴 05-28 22:15
    17

    佬试过反重力的模型降智了没,按理说反重力风控这么高应该不会降智的吧

  • lanvent 05-28 22:17
    18

    google经常拒绝帮忙找 ^-^,grok free搜索就够用吗

  • Kinney Lorraine 05-28 22:17
    19

    还行,我之前有个片子只记得场景,找了个类似的,慢慢就找到了

* 帖子来源Linux.do
返回