FIFO-Diffusion

1年前发布 47 0 0

FIFO-Diffusion是一种基于预训练扩散模型的新颖推理技术,用于文本条件视频生成。它能够无需训练生成无限长的视频,通过迭代执行对角去噪,同时处理队列中一系列连续帧的逐渐增加的噪声水平;该方法在头部出队一个完全去噪的帧,同时在尾部入队一个新的随机噪声帧。此外,引入了潜在分割来减少训练推理差距,并通过前瞻去噪来利用前向引用的好处。

收录时间:
2025-05-29
FIFO-DiffusionFIFO-Diffusion

FIFO-Diffusion是一种基于预训练扩散模型的新颖推理技术,用于文本条件视频生成。它能够无需训练生成无限长的视频,通过迭代执行对角去噪,同时处理队列中一系列连续帧的逐渐增加的噪声水平;该方法在头部出队一个完全去噪的帧,同时在尾部入队一个新的随机噪声帧。此外,引入了潜在分割来减少训练推理差距,并通过前瞻去噪来利用前向引用的好处。

数据统计

相关导航

SekoTalk

SekoTalk

SekoTalk是商汤科技(SenseTime)旗下Seko智能体平台推出的AI对口型视频创作工具,可以根据用户描述及角色图片自动生成与音频匹配的口型动画。SekoTalk主要功能包括多语种对口型生成、音频格式兼容、角色形象定制、多风格视频生成及多说话者支持。SekoTalk提供可视化编辑功能,支持直接查看和调整对口型效果,并可导出发布至不同平台。SekoTalk可以应用于剧情短片、动画制作及广告宣传视频等场景,能够有效提升创作效率与视频质量。

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...