目前的主流视频模型在人物场景占位、镜头调度、打斗镜头,整体表现不太好。现有的解决方案就是使用一些 3D 软件进行预演,导出视频发给视频模型进行模仿生成。
如果能训练出一个比较廉价的白膜视频模型,能够使用提示词或结构化的数据(可以使用主流大模型生成)准取的处理完成白膜视频的预演。这样是不是就可以解决目前的问题。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.