GPT-4与物理引擎结合的扩散模型,打造逼真流畅且合乎逻辑的视频

GPT-4与物理引擎结合的扩散模型,打造逼真流畅且合乎逻辑的视频

AIGC动态欢迎阅读

文章标题:GPT-4+物理引擎加持扩散模型,实现视频逼真、连贯、合理

关键词:物理、视频、模型、用户物体

文章来源:机器之心

文章字数:6142字

内容摘要:最近,随着扩散模型技术的应用,文本生成视频技术得到了进一步发展。然而,这类方法的计算成本通常较高,而且往往难以实现连贯的物体视频效果。为了解决这些问题,来自中国科学院深圳先进技术研究院、中国科学院大学和 VIVO AI Lab 的研究者们联合提出了一个全新的无需训练的文本生成视频框架——GPT4Motion。该框架结合了 GPT 等大型语言模型的规划能力、Blender 软件提供的物理模拟能力,以及扩散模型的文图生成能力,旨在显著提升视频合成的质量。有关项目的详细信息可以在以下链接找到:https://gpt4motion.github.io/。相关论文可在此链接获取:https://arxiv.org/pdf/2311.12631.pdf。如果您对代码感兴趣,请访问该链接查看详情:https://github.com/jiaxilv/GPT4Motion。

原文链接:欲了解更多信息,请点击以下链接:GPT-4+物理引擎加持扩散模型,生成视频逼真、连贯、合理

联系作者

文章来源:机器之心

作者微信:almosthuman2014

作者简介:专业人工智能媒体和产业服务平台

© 版权声明

相关AI热点

暂无评论

none
暂无评论...