想做ai数字人,喂聊天记录和语音

小二 2026-08-23 21:21 1

佬们,我看许多人分手,或者亲人离世特别难过的,就想着做ai数字人,喂语音喂聊天记录,刚有这个想法,我不懂编程,我只能用ai,佬们有什么好想法好建议吗?可以给我支支招

最新回复 (10)
  • WANGHaoo 08-23 21:25
    1

    蹲一下,期待好想法。

    我也想做一个。

  • 小二 楼主 08-23 21:28
    2

    刚有初步的想法 不知道能不能做出来^-^

  • 秋秋秋 08-23 21:30
    3

    这个东西我也有点想法但还没做,我的初步想法是利用大量材料,去模拟这个人的思维方式,聊天语气等,我觉得要有RAG语料库,复杂问题应该还会有skill ,让他知道为什么这么讲,比让他单纯的模仿来的重要

  • Nathan3 08-23 21:35
    4

    ai数字人很多了,前两年这个技术就挺多了的大厂也都在做。因为这两年生成式技术很火(diffusion model,NeRF,高斯泼溅),我记得是比较成熟了在论文里,大厂和强组都做了挺多demo出来了。

  • 麦子 08-23 21:36
    5

    黑镜的现实版,感觉用不了几年就会出来了

  • worldsHello 08-23 21:38
    6

    优必选是不是有个这种玩意?先是数字人,后面平移到机器人

  • Mark 08-23 22:28
    7

    哈哈哈有没有什么交流群,我也正在自己摸索,很多问题都不会,有同好可以交流吗?

  • Lx 08-23 22:31
    8

    很难做这个的,有些东西你没办法落地

  • BearCandy 08-23 22:35
    9

    最近也在尝试搞这个,主打情感陪伴+AI带货,目前是关注到了这几个项目

    MuseTalk

    CyberVerse

    站内大佬的 Opentaking

    声音的话选用index-tts-2

    但是视频实时处理很僵硬。

    目前只考虑了两层,但是边界没确定好比如说什么时候切换,精良层和实时层

    精良层负责热场,产品切换等。

    实时层负则实时处理。

    目前呢实时层是只有嘴和身体做固定重复的动作,精良层的话走的是minimax 路线,RTX5090生成15s视频要长达5min

    本人小白哈,个人观点,大佬勿喷,欢迎指点!

  • kk C 08-23 22:36
    10

    仿真还是动态生成,如果是仿真的真人交互,路还很长

* 帖子来源Linux.do
返回