AnimateDiff-Lightning 是字节跳动推出的最新文本到视频生成模型,采用渐进式对抗扩散蒸馏技术,实现了比原版 AnimateDiff 快十倍以上的生成速度。该模型仅需 4-8 步推理即可生成高质量视频,极大提升了视频内容创作的效率和质量。AnimateDiff-Lightning 特别适用于动画转绘和视频转视频场景,提供了卓越的生成效果和用户体验。
MotionShop 是一款由阿里巴巴开源的 3D角色视频替换框架,专为视频编辑和动画制作而设计。通过先进的视频处理和3D渲染技术,MotionShop能够高效地将视频中的某个角色替换为3D人物,同时不改变视频中的其他场景和人物。 被替换的3D人物能完整复刻原视频中人物的动作,保持动作一致。其核心功能包括自动检测视频中的人物、精确捕捉和模仿人类动作、替换为虚拟角色模型,并提供多种创意选项。
可灵AI是快手推出的新一代AI创意生产力平台,专为创意生产力而设计。它能够生成长达2分钟的高清视频,帧率高达30fps,分辨率达到1080p。可灵AI支持多种视频宽高比,适用于各种场景需求。其主要功能包括图生视频、视频续写、表情身体驱动等,能够将静态图像转化为生动的视频,并对已生成的视频进行续写。可灵AI利用3D人脸和人体重建技术,实现表情和肢体的全驱动,适合艺术视频创作和其他视觉内容的生成。
pyvideotrans是一个开源的视频翻译配音工具(开源协议GPL-v3),可将一种语言发音的视频,翻译为另一种语言发音的视频,并嵌入该语言字幕。它利用了先进的语音识别、机器翻译和语音合成技术,实现了视频的自动翻译和配音功能。
Runway AI是面向创作者的多模态生成式 AI 平台,支持文本生成视频、图像转视频、视频编辑与特效处理,涵盖抠像、背景替换、物体移除、画质增强等功能。无需复杂剪辑技能,即可将创意转化为高质量作品,广泛应用于影视制作、广告短片、社交媒体视频与数字艺术创作。
Vimi是商汤科技推出的可控人物视频生成大模型,通过动作视频、动画、声音和文字等多种驱动元素,Vimi能够生成与目标动作一致的人物视频。它不仅能精准控制人物表情和肢体动作,还能生成合理的头发、服饰和背景,支持光影变化。Vimi突破了传统AI视频生成的限制,能够稳定生成分钟级的单镜头人物视频,画面效果自然流畅。无论是娱乐创作还是专业视频制作,Vimi都是您的理想选择。
白日梦AI是一款由深圳光魔科技推出的 AI 视频创作平台,支持文字生成视频、AI分镜、智能配音、角色生成等功能,帮助用户快速制作高质量视频。
寻光是由阿里达摩院推出的一站式AI视频创作平台。它旨在通过人工智能技术提供全新的视频创作模式,重塑传统视频制作的全流程。寻光平台集成了剧本创作、分镜图设计、视频素材编辑等步骤,让创作者可以在同一个平台上流畅完成视频创作。
ProPainter 是一款先进的视频修复工具,利用 AI 技术去除视频中的特定对象和水印。通过循环流补全网络和 Transformer 技术,ProPainter 能够智能检测并移除视频中的移动物体,修复损坏区域,恢复视频的完整性。无论是去除水印还是修复视频,ProPainter 都能提供高质量的解决方案。
MimicMotion是腾讯推出的高质量人类动作视频生成框架,利用置信度感知的姿态引导技术,生成时间平滑、细节丰富的动态视频。该框架通过区域损失放大和渐进式潜在融合策略,实现了任意长度视频的高效生成,并对视频内容进行精确控制,包括动作、姿势和视频风格等,适用于多种应用场景。
Crayo AI 是一个专为创建病毒式短视频而设计的平台。它利用人工智能技术,自动生成视频字幕、特效、背景和音乐,使用户可以在几分钟内创建引人入胜的短视频。这个工具特别适用于 TikTok、Instagram 和 YouTube Shorts 等平台,帮助用户快速制作吸引人的视频内容。
AI Coevo是一个利用人工智能技术将视频转换成动漫风格的平台。它提供了一个简单的界面,用户可以上传自己的视频,然后选择不同的动漫风格进行转换。例如,可以将真人视频转换成像素风格或者平面动漫风格的视频。此外,AI Coevo还提供了其他功能,比如文生图和角色动态,让用户可以通过输入文本提示词快速生成绘画和艺术作品,或者上传一张人物图像和一个动作视频,让图像中的人物做出同样的动作。
VidIQ是一款专为YouTube创作者设计AI视频营销工具。它提供了一系列工具来帮助用户优化视频内容,为视频创作者、营销人员和品牌提高视频在YouTube上的搜索排名和曝光率。
Diffutoon是一种先进的动漫风格渲染技术,它能够将真人视频转换成动漫风格。这个技术由阿里巴巴和华东师范大学的研究人员推出,基于扩散模型的可编辑卡通着色技术。Diffutoon具备内容一致性、高分辨率输出和智能编辑功能,适用于高分辨率和快速运动的视频。
Character-1 是Hedra Labs推出的人物角色视频生成工具,它可以通过文本和图片生成唱歌视频。它是一个全新的创作平台,为用户提供了无限的视频创作机会。在Hedra的世界里,用户可以成为造物主,创作出丰富多彩的世界、角色和故事,拥有完全的创作控制权。
Dream Machine是一款由Luma AI推出的AI视频生成模型,能够直接从文本和图像快速生成高质量的逼真视频。可以在120秒内生成120帧视频,具备流畅的运动、电影摄影和戏剧效果。它理解人物、动物和物体与物理世界的互动,确保视频角色的一致性和物理准确性。
V-Express是由南京大学和腾讯AI实验室共同开发的一项技术,旨在通过参考图像、音频和一系列V-Kps图像来生成说话的头像视频。这项技术可以根据不同的信号,如声音、姿势、图像参考等来控制视频内容,确保即使是弱信号也能有效地影响最终生成的视频,使视频生成更加逼真和多样化。
VidAU AI是一个强大的视频和音频生成平台,它能够帮助用户简单地通过产品链接或描述在几分钟内批量生成引人入胜的营销视频,并支持通过逼真的AI数字人以不同的语言和口音作为产品介绍。此外,VidAU AI还提供了丰富的视频编辑功能,如换脸、翻译、字幕翻译、水印或字幕去除、混合等。
美图MoKi是美图公司推出的一款AI短片创作工具。它能够在用户完成脚本、视觉风格、角色等前期设定后,自动生成分镜图并转换为视频素材。此外,MoKi还提供智能剪辑、AI配乐、AI音效和自动字幕等功能,帮助用户串联素材并制作成短片。
MusePose是一个由腾讯Lyra Lab开发的姿态驱动的图像到视频生成框架,专注于虚拟人类的生成。它能够在给定的姿态序列下,生成参考图像中的人类角色的舞蹈视频。这个框架使用了先进的扩散模型和姿态对齐算法,以生成与输入姿态高度匹配的平滑、逼真的动画。
MuseTalk是由腾讯推出的一个实时的高质量音频驱动唇形同步模型,能够根据输入的音频信号自动调整数字人物的面部图像,使其唇形与音频内容高度同步,支持多种语言,并实现每秒30帧以上的实时处理速度。这意味着观众可以看到数字人物的口型与声音完美匹配的效果。
视界一粟YiSu是由极佳科技联合清华大学自动化系研发的一款中国首个超长时长、高性价比、端侧可用的Sora级视频生成大模型。不仅擅长生成视频,还能执行文本到视频转换、图像到视频合成等多种视频编辑任务。
MotionFollower是一款基于AI的视频处理工具,它能够将 A 视频中的动作和姿势克隆迁移到你想替换的 B 视频源中。同时,它还能保留 B 视频中的背景、主角的外观以及相机的移动。换句话说,这项技术不仅能帮你换脸,还能同时帮你换动作,并且保持原视频的整体风格。
ViViD是阿里巴巴推出的一款视频虚拟试穿技术。这项技术使用了扩散模型(Diffusion Models),旨在通过合成视频让消费者看到衣物穿在自己身上的真实效果。ViViD解决了传统基于图像的方法在视频中应用时出现的时空不一致问题,如闪烁和伪影,同时生成高质量、细节丰富的试穿视频。
牛学长文件修复工具是一款一款专业的数据恢复软件。不仅提供了基本的文件修复功能,还引入了AI技术来增强视频和图片的质量。这款工具可以将模糊的视频通过AI增强技术升级到超清4K分辨率,即使是低质量的视频也能变得更加清晰。此外,它还能放大和增强照片的质量,确保图像在放大过程中不失真,保持清晰度和干净度。
Veggie AI 是一种AI在线动画视频生成工具,它利用人工智能技术生成可控视频。用户可以输入图像、视频或文本提示,来创建与提供的动作和角色描述完全匹配的短视频。
Typeframes是一个AI在线视频创作平台,旨在帮助用户快速生成高质量的产品介绍视频。该平台的核心优势在于其便捷性和易用性,无需用户掌握复杂的视频编辑软件,即可通过简单的文本输入快速生成专业的视频内容。
ToonCrafter是一个AI驱动图像生成卡通动画视频工具。它可以通过预训练的图像到视频扩散模型,实现两张卡通图片之间的平滑过渡,从而创造出动画效果。
可灵大模型是快手AI团队自研的一款视频生成大模型,采用类似Sora的技术路线,能够生成符合物理规律的大幅度运动视频,模拟真实世界的特性。支持生成长达2分钟的30fps的超长视频,分辨率高达1080p,且支持多种宽高比。2024年6月,快手正式推出了可灵大模型,并在快影App开放邀测体验。
Project Blink 是 Adobe 实验室推出的一个基于云端的AI视频编辑工具,利用人工智能技术来简化视频编辑过程。这个工具可以让用户像编辑文本一样编辑视频,通过视频转录文本来剪辑实际视频内容。用户可以搜索视频中的特定对象或声音,例如大象、猫,或者笑声等。