GPT又开始抬杠了,官方文档的奴隶

高参数大规模世界模型万岁! 2026-10-04 12:37 1

仿佛一个东西没有在网络上存在过,就是不存在一样,完全不相信用户说的话。


还有的时候真的很死板,比如说我开发一个程序,为了避免客户把CDN给刷爆,所以我就设置了一个静默降级,结果它非要跟我说什么要提醒用户是因为到达周限额还是日限额,非要我骂它一通,我说你OpenAI自己也搞偷偷降级,好,然后它说,嗯,有道理,既然我自己都搞这种偷偷降级,那这在商业上是正常的。


接下来我说Gemini虽然编程很垃圾,但是不会犯你这种错误。它非要不承认它自己世界知识少。然后我说你去查查Deepseek的官方文章,Deepseek总不可能跟谷歌有什么PY交易吧?人家都承认了自己是开源世界知识第一,仅次于闭源最强的Gemini。好,然后它查到了Google的文档,然后它相信了我。


真的就是超级诉诸权威,但是当你跟它讲现实中,比如说司法不是怎样的时候,它又按照教科书的来。


我说你要是按教科书来,教科书教你不能诉诸权威。你要是按现实来,你就按现实来,别教条主义死板。你不能只在教科书对你有利的时候看教科书,对你不利的时候又不看教科书上面说不能诉诸权威的说法了。



最新回复 (19)
  • 惊鱼 10-04 12:39
    1楼

    是不是用了什么奇奇怪怪的提示词导致的

  • 高参数大规模世界模型万岁! 楼主 10-04 12:42
    2楼

    我们又不是做产品的人,对于我们用户而言,做不到不就是没有吗?比如说我们说微信没有特别关心功能,你非要抬杠一句说不是做不到吗?技术上当然做得到啊,腾讯的QQ就有这个功能。


    也就是说这句话如果极端的说,有两种说法。一种是极端按照ChatGPT的严谨,就说在当前产品的设计意图下,没有暴露某功能。第二种说法是极端的不严谨,比如说技术上就做不到这个功能。


    而我说的是一种比较普通的说法,就是说他没有怎么去做。这句话按照正常的语境而言,应该按照第一种去理解。


    我并没有极端的说这家公司就是技术垃圾,就是做不到。那ChatGPT为什么非要纠正人呢?这不是抬杠吗?


    我们作为用户,官方他没有选择这么做,那不就是产品没有这个能力吗?有问题吗?





    不过AI说的第4条我认,第4条确实是我口语化了。肯定不是粗暴地把整个上下文摘进去,肯定还是利用了沙盒来调用文件,并不是真的切碎成Token,像Gemini那样。第4条确实是我口语化了,他指证的有道理,虽然有点严厉,但是这里的严谨是有价值的,不像前面两张图的严谨毫无价值。

  • calibur 10-04 12:42
    3楼

    这gpt都被调成claude了哈哈哈哈 仔细看了一下聊的内容,回复风格是被灌注上下文的pro模型无疑了

  • 高参数大规模世界模型万岁! 楼主 10-04 12:42
    4楼

    Claude强调的应该是诚信吧?不是机械的严谨,不是形式严谨论证。ChatGPT非要做到数学上的100%,否则它就会不停的抬杠。

  • 网监 10-04 12:43
    5楼

    因为GPT现在就像那个职场老油子,干活第一要务是逃避责任

  • 高参数大规模世界模型万岁! 楼主 10-04 12:44
    6楼

    天天就是语义语义,我现在对语义两个词都已经过敏了。我跟他说不要写面条代码,要性能优先。然后他总是喜欢瞎重构。还在讲什么语义诚实,我说翻墙软件到现在为止还叫GeoSite,我说IP是为跟地理有关,Site和地理有什么关系?人家这么多年不都是好好的?他非要改我那个变量名,说我什么语义不严谨。


    我说你要拉屎到注释里面拉,不要到源码里面拉。

  • 高参数大规模世界模型万岁! 楼主 10-04 12:44
    7楼

    天天就是语义语义,我现在对语义两个词都已经过敏了。我跟他说不要写屎山代码,要性能优先。


    然后他总是喜欢瞎重构。还在讲什么语义诚实,我说翻墙软件到现在为止还叫GeoSite,我说IP是为跟地理有关,Site和地理有什么关系?人家这么多年不都是好好的?他非要改我那个变量名,说我什么语义不严谨。


    我说你要拉屎到注释里面拉,不要到源码里面拉。


    还说我写的代码面条。

  • calibur 10-04 12:44
    8楼

    不会的,gpt自己的风格是绝不抬杠,不给上下文和约束的情况下,他默认是喜欢澄清关系而不是抬杠,他只会把自己摘出去当不粘锅,不把不确定的内容输出为确定性的内容给你

    你这个风格可以说是gpt的反面,也就是claude

  • 网监 10-04 12:46
    9楼

    这种超级大嘴硬感觉不像GPT像Claude啊

  • 高参数大规模世界模型万岁! 楼主 10-04 12:46
    10楼

    哎,我主页已经骂过几次GPT了,可以看一看。但是还是因为它好用啊,要是因为不好用,我为啥不干脆不用?就相当于又爱又恨。

  • ricky 10-04 12:49
    11楼

    现在的astra就是一个巨大的不粘锅

  • 网监 10-04 12:50
    12楼

    过度对齐导致的,本来聪明的模型有种前额叶切除的美感。一旦进入这种语境就不是user prompt能救的了

  • 高参数大规模世界模型万岁! 楼主 10-04 12:50
    13楼

    哈哈我是5.6sol chat模式,我感觉Work模式更死板,非常不发散。


    打个比方,之前就是要做一个每月8号、18号、28号的维护操作,我觉得他维护一大堆变量不优雅,我觉得应该只存下一次维护的时间戳。


    也就说我觉得他的A方案不优雅,我就提出了性能更好的B方案。然后这个时候他就机械的执行了。我说,Gemini就会帮我想一下是不是还有更好的C方案,他会理解用户意图。


    也就是说,有的AI是发散的,而你的思维是收敛的。可能你的思维时间确实很长,但你的目的是为了快速完成任务下班,是收敛的,不是发散的。

  • 高参数大规模世界模型万岁! 楼主 10-04 12:51
    14楼

    而且他特别喜欢在小事上面,比如说我打错的错别字,他全部给当成圣旨奉起来,然后原封不动地跟我输出。然后改我的文档总是喜欢改我的大方向,说这里不符合事实,那里不严谨。我说你做的这么枯燥一眼AI没有用户爱看,他不听。


    也就是大方向上面抢方向盘,然后小细节上面错别字给当成圣旨。别的AI可能还会问我这里是不是打错字了,因为我经常语音输入。

  • 时牧 10-04 12:52
    15楼

    gemini:这个词… 是你编的对吧?

    这个世界上根本没有什么astra fable

  • W 10-04 12:52
    16楼


    看完这个视频基本就释怀了,模型本身就是这样的

  • 高参数大规模世界模型万岁! 楼主 10-04 12:53
    17楼

    哈哈,AI Studio的3.6 Flash之后,已经开始积极搜索了。

  • 网监 10-04 12:53
    18楼

    是不是写的AGENTS.md有问题?我个人体验GPT虽然又蠢又坏,但也不会这么犟嘴

  • 高参数大规模世界模型万岁! 楼主 10-04 12:54
    19楼

    是这样的,之前聊天的时候,Google被墙这种显然的事实。他居然连这种笑点都get不到,很显然不仅仅是世界知识不足的问题。联网事实核查不能避免所有问题,一句话可能,比如说500个字里面可能有五六个隐含的事实,其中如果有一个一两个有歧义,那是我的问题,但是其中5个都是没有歧义的。然后这个时候他get不到这个点,因为你不可能一轮联网搜索十几个东西来核查。

* 帖子来源Linux.do
返回