SekoTalkSekoTalk是商汤科技(SenseTime)旗下Seko智能体平台推出的AI对口型视频创作工具,可以根据用户描述及角色图片自动生成与音频匹配的口型动画。SekoTalk主要功能包括多语种对口型生成、音频格式兼容、角色形象定制、多风格视频生成及多说话者支持。SekoTalk提供可视化编辑功能,支持直接查看和调整对口型效果,并可导出发布至不同平台。SekoTalk可以应用于剧情短片、动画制作及广告宣传视频等场景,能够有效提升创作效率与视频质量。
AnimateAnyoneAnimateAnyone是一个基于深度学习的视频生成模型,它能够将静态图片或视频转换为动画。该模型由Novita AI非官方实现,灵感来源于MooreThreads/Moore-AnimateAnyone的实现,并在训练过程和数据集上进行了调整。
CogVideoX-5BCogVideoX是一个开源的视频生成模型,由清华大学团队开发,支持从文本描述生成视频。它提供了多种视频生成模型,包括入门级和大型模型,以满足不同质量和成本需求。模型支持多种精度,包括FP16和BF16,推荐使用与模型训练时相同的精度进行推理。CogVideoX-5B模型特别适用于需要生成高质量视频内容的场景,如电影制作、游戏开发和广告创意。
造梦阁AI造梦阁AI是一款AI推文创作工具,可以帮助用户自动将小说文字转化为短视频。造梦阁AI以「一键成片」为核心功能,助力用户快速生成高质量视频内容,覆盖从文案创作到视频导出的全流程,3分钟生成抖音/快手/B站爆款推文视频。造梦阁AI支持智能匹配小说场景素材库,AI自动生成配音字幕,零基础创作百万播放量视频。每日更新热门小说推文模板,助力自媒体创作者高效变现!
Keeva AIKeeva AI是一个多功能的AI数字人视频创作工具,专为海外中小企业和个人创作者提供视频创作解决方案。Keeva AI利用人工智能技术,能够智能生成和翻译视频脚本,并结合高质量的公共人像和模板,可以实现一键生成数字人营销视频的服务。用户只需输入视频主题,Keeva AI即可自动生成脚本并制作完整视频,同时支持上传自有脚本,选择数字人形象和语音生成视频。
UniAnimateUniAnimate是一个用于人物图像动画的统一视频扩散模型框架。它通过将参考图像、姿势指导和噪声视频映射到一个共同的特征空间,以减少优化难度并确保时间上的连贯性。UniAnimate能够处理长序列,支持随机噪声输入和首帧条件输入,显著提高了生成长期视频的能力。此外,它还探索了基于状态空间模型的替代时间建模架构,以替代原始的计算密集型时间Transformer。UniAnimate在定量和定性评估中都取得了优于现有最先进技术的合成结果,并且能够通过迭代使用首帧条件策略生成高度一致的一分钟视频。
VideoTetrisVideoTetris是一个新颖的框架,它实现了文本到视频的生成,特别适用于处理包含多个对象或对象数量动态变化的复杂视频生成场景。该框架通过空间时间组合扩散技术,精确地遵循复杂的文本语义,并通过操作和组合去噪网络的空间和时间注意力图来实现。此外,它还引入了一种新的参考帧注意力机制,以提高自回归视频生成的一致性。VideoTetris在组合文本到视频生成方面取得了令人印象深刻的定性和定量结果。
PCMPhased Consistency Model(PCM)是一种新型的生成模型,旨在解决Latent Consistency Model(LCM)在文本条件高分辨率生成中的局限性。PCM通过创新的策略在训练和推理阶段提高了生成质量,并通过广泛的实验验证了其在不同步骤(1步、2步、4步、8步、16步)下与Stable Diffusion和Stable Diffusion XL基础模型的结合效果。