拿QQ聊天记录微调了一个“自己”模型

Eric Terminal 2026-08-18 23:57 1

这两天无聊在玩本地模型,然后想着,要不要试试微调

说干就干,导出了903万条QQ聊天记录,里面大概有3万条和我有关的,洗完之后大概有5600条对话数据,103万的Token

慢慢悠悠折腾了两三天

然后拿我的聊天数据去调了个“我”

模型是 DeepSeek V4 Flash 0731

租了8张RTX 5090

炼了个38.4M的LoRA,炼完推理就是自己电脑本地跑的


实测对话效果







也是非常像我啊,不知道怎么回就回一个^-^(因为我Mac按a2就能打出来)

但是我现在又不知道问什么了,佬们有没有什么想问的?让我去问问?


还有训练时候的nvitop,也是非常的好看,如此性能猛兽在花了钱的这几个小时里面,就是属于我的,想想觉得也挺好的(虽然有点贵)

8*5090(32GB)+110核CPU+480GB内存



这个LoRA是训练集练了两轮的,我感觉效果还是不错的

一共跑了三趟,一趟大概要3个小时

所以好玩归好玩,-235.02 ¥ ^-^


多的时间还试了下直接跑最基础的DeepSeek的推理



不过因为是多卡并联加上我没怎么优化(没时间了)速度还是受限,就差不多2token/s,比官方慢50倍

最新回复 (5)
  • NekoMirra 08-19 00:23
    1

    大佬模型微调有没有教程喵,想微调一个猫娘gpt来玩玩

  • Eric Terminal 楼主 08-19 00:24
    2

    但是GPT是闭源模型呀,GPT官方出的那个微调把训练集传上去好像就可以了?我这个是开源模型用来调的?

  • NekoMirra 08-19 00:25
    3

    啊我的意思是想拿开源的qwen Q4量化后的模型微调一个猫娘,随手起了个名字()

  • wangyw 08-19 00:26
    4

    厉害啊大佬,不错,啥时候写个教程教教我们啊

  • Eric Terminal 楼主 08-19 00:28
    5

    咝,有道理奥,我差不多开学了,我看看开学后的周末试试写一篇教程吧?

* 帖子来源Linux.do
返回