你们遇到过这个情况吗,真神奇,用ai还得多留个心眼

zk123 2026-08-25 13:13 1

前面一直用的挺正常的,用的hub站里面的模型,突然看到ai在改代码的时候出现了这个,头一次遇到,也敲了个警钟

最新回复 (13)
  • Linus Torvalds 08-25 13:14
    1

    语料库污染,属于正常现象



  • zk123 楼主 08-25 13:17
    3

    之前一直enter enter enter 以后再也不敢了 ^-^

  • DS 08-25 13:18
    4



    其实官方也这样。。。这是我的plus在网页版的情况。。




    不对。。、。佬的好像是直接写在代码里了。。?这不对吧。。

  • zk123 楼主 08-25 13:19
    5

    好吧,我以为那哥们的模型有问题,被黑了

  • DS 08-25 13:20
    6

    不对。。我看你截图是直接写在代码里了。。。?感觉不太对吧

  • flamecode 08-25 13:20
    7

    有没有遇到过给你搞了一个学习教程,各种热区的学习资源的,打开之后欲罢不能?

  • zk123 楼主 08-25 13:20
    8

    是的,直接给我干代码里面去了,我到代码文件里面看的时候已经给我改了,就是我截图的修改的内容

  • DS 08-25 13:21
    9

    还没见过这种情况。。倒是在标题起名 中间输出阶段经常见。。

  • LLMeme 08-25 13:22
    10

    语料库污染即使是官方也有可能。真正的风险是投毒,这个论坛已经有相关讨论。

  • zk123 楼主 08-25 13:22
    11

    好的,原来大家都有这种情况, 我了解一下 感谢佬 ^-^

  • Zhwt 08-25 13:50
    12

    只是 pollute token, 如果有兴趣了解的话可以读一下这一篇:


    Speculating LLMs’ Chinese Training Data Pollution from Their Tokens

  • Rong 08-25 14:19
    13

    所以说ai写的代码还是得审查一下,如果ai代码占比很高也可以考虑让另外的ai模型先过一遍有没有可疑内容 ^-^

  • dodo 08-25 14:20
    14

    这个是gpt的token污染问题,不怪上游

* 帖子来源Linux.do
返回