关于让GPT模型在工作中持续输出指纹归因以侦测是否降智的想法

实验喵 2026-09-22 10:33 1



看到这个指纹归因工具之后我在想,是否可以在agent中加入提示词,命令GPT在每次回复的开头都要输出指纹归因(如果可以缩小点数字数量并仍然能够判断?),然后自动判断是否降智或掺水?


佬友觉得这个想法具有可行性吗?


我目前也不是很了解指纹归因原理。如果上下文会严重干扰指纹归因的判断,当我没说。

最新回复 (5)
  • 一梦浮生 09-22 10:49
    1

    糖果问题很容易判断出来了。

  • 王锄地 09-22 10:51
    2

    原理好像是模型的权重中默认对某些数字的权重高一点。但确实不知道上下文是否会影响这个值了

  • KiritoXD 09-22 10:58
    3

    开个心跳任务定时在 side chat 里面回答降智问题

  • 实验喵 楼主 09-22 10:58
    4

    如果这种方式能够实现,我认为好处是防止掺水的渠道在检测到你在检测模型智商的时候临时给你路由一个真的。


    不然的话,只是单开话题测的话,你怎么知道会不会被供应商耍小巧思呢?

  • KiritoXD 09-22 11:08
    5

    side chat 会带上下文的,不是干净上下文,不过供应商搞关键词匹配的话,你那种方式应该也不行 ^-^

* 帖子来源Linux.do
返回