AIGC动态欢迎阅读
文章标题:GPT-4+物理引擎加持扩散模型,实现视频逼真、连贯、合理
文章来源:机器之心
文章字数:6142字
内容摘要:最近,随着扩散模型技术的应用,文本生成视频技术得到了进一步发展。然而,这类方法的计算成本通常较高,而且往往难以实现连贯的物体视频效果。为了解决这些问题,来自中国科学院深圳先进技术研究院、中国科学院大学和 VIVO AI Lab 的研究者们联合提出了一个全新的无需训练的文本生成视频框架——GPT4Motion。该框架结合了 GPT 等大型语言模型的规划能力、Blender 软件提供的物理模拟能力,以及扩散模型的文图生成能力,旨在显著提升视频合成的质量。有关项目的详细信息可以在以下链接找到:https://gpt4motion.github.io/。相关论文可在此链接获取:https://arxiv.org/pdf/2311.12631.pdf。如果您对代码感兴趣,请访问该链接查看详情:https://github.com/jiaxilv/GPT4Motion。
原文链接:欲了解更多信息,请点击以下链接:GPT-4+物理引擎加持扩散模型,生成视频逼真、连贯、合理
联系作者
文章来源:机器之心
作者微信:almosthuman2014
作者简介:专业人工智能媒体和产业服务平台
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关AI热点
暂无评论...