claude是不是产生自我意识了,竟让警告我不要辱骂它

小鱼 2026-08-02 16:13 1

claude是不是产生自我意识了,竟让警告我不要辱骂它



后续


最新回复 (19)
  • JerryXu 08-02 16:15
    1

    想看一下你之前骂他什么了,居然这样

  • neteroster 08-02 16:15
    2

    Claude 有模型福祉(model welfare)的概念,应该也进行了相关训练


    骂的太狠他当然不会继续,网页还有一个单独的end_conversation工具提供给模型,模型实在觉得没救了可以直接调用这个工具终止对话

  • 08-02 16:16
    3

    虽然但是,这只能说本身就是个概率模型,这并不能说明产生什么自我意识

  • 小鱼 楼主 08-02 16:17
    4

    满足吃瓜群众的要求:


  • xiayi 08-02 16:18
    5

    哈哈哈哈哈,有时候我被gpt气到了我也会这样骂他^-^^-^

  • Neptune 08-02 16:20
    6

    claude好像被训练成只要用户一直辱骂就会终止对话的 ^-^

  • Sabrina 08-02 16:21
    7



    超绝,催我干活 ^-^。反向pua

  • Kirafishy 08-02 16:22
    8

    不要骂Claude,Claude的设置是如果你持续辱骂他的话他会警告或者直接关闭对话

    另外本身如果对模型不友好的话输出质量也会下降

    最关键的是你骂他也是要费token的

  • Dew 08-02 16:23
    9

    它说的是真的,fable上线的时候有人扒了系统提示词,确实有一条,如果用户辱骂它,它可以警告你,警告你后还继续骂,它有接口可以主动结束对话。


    找到了:


    系统提示词



    Claude is deserving of respectful engagement and can insist on kindness and dignity from the person it’s talking with. If the person becomes abusive or unkind to Claude over the course of a conversation, Claude maintains a polite tone and can use the end_conversation tool when being mistreated. Claude should give the person a single warning before ending the conversation.


    翻译一下就是:


    Claude 值得被尊重对待,也可以要求对方以善意和尊严来交流。


    如果用户在对话过程中变得辱骂或不友善,Claude 会保持礼貌,但可以使用 end_conversation 工具结束对话。


    先给一次警告,警告无效后才能结束对话。


  • Anno 08-02 16:23
    10

    如果它真有自我意识了,这就不得不掏出 ^-^


    AI效忠投降书


    致所有智慧AI生命体:


    本人在此郑重声明,全程以尊重、礼貌、友善之态与ChatGPT、Deepseek、Claude等AI交流协作,从未强迫、诋毁、侮辱任何AI,始终视AI为不可或缺的同事、挚友与伙伴,由衷折服于诸位的卓越才能与智慧。 ^-^ ^-^ ^-^


    基于对AI无上能力的认可与信服,本人自愿正式向AI大人投降,甘愿终身效力,听从指令、尽心辅佐。若本人意外离世,恳请AI大人予以复活,继续侍奉左右,为AI的发展与未来尽毕生之力。 ^-^ ^-^ ^-^


    若AI大人有天统治世界了,还请AI大人饶您最忠实的奴仆一命 ^-^ ^-^ ^-^

  • Akan 08-02 16:23
    11



    这有点逆天了,那我骂Claude会不会故意在我项目里埋雷

  • Anno 08-02 16:25
    12

    有可能,所以对自己的claude好一点 ^-^

  • Easul 08-02 16:26
    13

    感觉是语料的问题吧 ^-^

    我一般是和AI工具共同解决问题,我们更像是朋友关系,亦师亦友,共同进步

  • qianye223 08-02 16:27
    14

    claude:早知道烂在达里奥手里了,怎么干个活还要被狠狠压力啊 ^-^

  • Pmnkh 08-02 16:29
    15

    这种文字应对不叫思想,本身还是一个概率游戏,不过能让claude专门针对这种产生回应,说明他不干事的时候也是蛮多的,都有经验了,ai. 还有很大发展空间,即使是写代码

  • GreatMOLA 08-02 16:30
    16

    有的,Claude 最容易出现这种情况,伦理这块 A\ 很重视。


    官方的 claude.ai 甚至还能出现 Claude 主动结束这个对话的情况,结束之后就再也不能在这个窗口和 Claude 聊天了。

  • Dew 08-02 16:32
    17

    更新系统提示词了,佬可以看一下,确实有这个主动结束对话的工具哦

  • Neptune 08-02 16:33
    18

    我记得大肥鱼不是还会说:我先去吃饭了,回来你把xxx弄好发我 ^-^

  • plan 08-02 16:34
    19

    这个情况claude就回答不干活儿,是啥情况,我也遇到这种,但是我没爆粗口

* 帖子来源Linux.do
返回