白膜视频模型遐想

cKnight 2026-09-22 11:05 1

现状


目前的主流视频模型在人物场景占位、镜头调度、打斗镜头,整体表现不太好。现有的解决方案就是使用一些 3D 软件进行预演,导出视频发给视频模型进行模仿生成。


遐想


如果能训练出一个比较廉价的白膜视频模型,能够使用提示词或结构化的数据(可以使用主流大模型生成)准取的处理完成白膜视频的预演。这样是不是就可以解决目前的问题。


问题



  • 由于是现在视频模型的能力问题,但是后面肯定迭代这个能力问题肯定会被解决。


不知道大家有什么看法

最新回复 (10)
  • andforce 09-22 11:11
    1
    https://gooizwbddbxvg.app.kimi.com/

    kimi 的 3D 导演台就行
  • cKnight 楼主 09-22 11:15
    2
    @andforce 是的目前导演台是 OK 的,但是整体的复杂度,学习成本还是蛮高的,如果要做一些比较复杂的调度场景的话还是不太好搞。
  • andforce 09-22 11:29
    3
    @cKnight #2 这个导演台是 AI 用的,不是给人用的。
  • levn 09-22 12:06
    4
    世界模型
  • Rorysky 09-22 12:08
    5
    你这个不就是 jev 的思路么? 输出简化
  • Rorysky 09-22 12:08
    6
    大有可为!
  • cKnight 楼主 09-22 13:05
    7
    @levn 这个太大了,我想的应该是个比较廉价且针对性比较强的模型
  • cKnight 楼主 09-22 13:05
    8
    @Rorysky #5 你还别说差不多是这个意思,用廉价的成本干好一件事
  • strobber16 09-22 14:04
    9
    您是不是在找:DLSS5
  • cKnight 楼主 09-22 14:57
    10
    @strobber16 之前在 gta 的视频中看到过这个,我瞅瞅
* 帖子来源V2EX
返回