模型框架
-
实时创建和渲染逼真的动态3D头像的技术-BakedAvatar
一项实时创建和渲染逼真的动态3D头像的技术-BakedAvatar,可通过简短视频复制出人物3D头部,能在移动设备上进行实时渲染,编辑和调整头像的表情和姿势。。 项目地址: https://buaavrcg.github.io/BakedAvatar/ 《BakedAvatar:用于实时头像合成的烘焙神经场》是一篇关于头像合成的论文。该方法可以从单目视频中生成基于…
-
阿里巴巴项目aceChain-FACT,只要上传你的照片克隆你自己
支持零样本人像生成,我们使用了数百万个精美的人像进行模型训练。我们有100多个高级定制模板可供选择。我们的模型支持CPU和二级推理时间。FaceChain-FACT生成的人像照片是二级的。简要总结:FaceChain-FACT是一个零样本人像生成模型,不需要用户进行LoRA模型训练,只需要一张用户的照片即可生成定制的人像照片。相比其他商业应用,我们的生成速度提高了100倍,支持…
-
能够直接操纵图像中的背景或对象项目DragNUWA 发布了在线体验地址
DragNUWA是一个由yinsming创建的Hugging Face空间,可以发现由社区制作的令人惊叹的机器学习应用程序。 体验地址: https://huggingface.co/spaces/yinsming/DragNUWA
-
Meta发布了audio2photoreal 演示,可以从对话音频中生成逼真的面部、身体和手势
项目地址: https://people.eecs.berkeley.edu/~evonne_ng/projects/audio2photoreal/ 代码: https://github.com/facebookresearch/audio2photoreal 内容:1 Meta Reality Labs研究,2加利福尼亚大学伯克利分校。简而言之:从对话的音频中,我们生成相应…
-
ComfyUI Portrait Master 2.2 版本发布,新增了一个姿势库
代码库:https://github.com/florestefano1975/comfyui-portrait-master/ 提供了与 Portrait Master 兼容的工作流程文件,包括对姿势的管理和控制。 集成了放大器和两个 ControlNet 以管理角色的姿势。 ComfyUI肖像大师是一个帮助AI图像创作者生成人物肖像提示的节点。通过ComfyUI Manag…
-
一个基于扩散模型让人物头像说话的框架DreamTalk
DreamTalk是一个基于扩散模型的框架,由清华大学、阿里巴巴和华中科大共同开发。它能够根据音频让人物头像照片说话、唱歌并保持嘴唇的同步和模仿表情变化。该项目使用扩散模型生成动态和表情丰富的说话头部动画,包括去噪网络、风格感知的嘴唇专家、风格预测器、音频和视频处理以及数据和模型训练等关键组件。 亮点: DreamTalk不仅能够处理和生成训练过程中见过的面部类型和表情,还能有…
-
阿里发布的虚拟服装试穿 – Outfit Anyone
阿里发布的虚拟服装试穿 – Outfit Anyone:只需要一张人物照片和服装照片就可以让那个人穿上这个衣服,特色是可以为不同的姿势和身体形状创建高质量的虚拟试穿。(目前还没有代码) 体验地址: https://huggingface.co/spaces/HumanAIGC/OutfitAnyone
-
字节跳动开发了一种名为StemGen的音乐生成模型
字节跳动开发了一种名为StemGen的音乐生成模型。该模型能够通过聆听和理解给定的音乐上下文来生成新的音乐。它能够分析音乐的特点,如旋律、节奏和风格。 StemGen是一个音乐生成模型,它可以根据音乐的上下文生成音乐。它采用了非自回归语言模型类型的架构,可以生成各种乐器的音轨。模型可以根据给定的音频上下文生成新的音轨,并与现有音频混合,实现交互式音乐生成。 项目地址: http…
-
阿里出品的真人跳舞方案:DreaMoving,图片+文字提示就能生成高质量舞蹈视频
DreaMoving是一个基于扩散的可控视频生成框架,用于生成高质量的定制人类视频。它可以根据给定的目标身份和姿势序列,在任何地方生成目标身份跳舞的视频。该框架包括视频控制网络和内容指南,可以生成高质量和高保真度的视频。DreaMoving在未见过的领域也表现出强大的泛化能力。 项目地址: https://dreamoving.github.io/dreamoving/
-
AI 能将视频中的主题转化为 SVG 素描 – sketchvideo
AI 能将视频中的主题转化为 SVG 素描!因此,素描视频合成可以实现各种渲染技术,包括调整大小、填充颜色以及在原始背景图像上叠加涂鸦。 项目地址: https://sketchvideo.github.io/ 这篇内容介绍了一种基于优化的视频素描生成框架,通过使用逐帧的贝塞尔曲线来表示视频。首先,通过交叉帧笔画初始化方法来确定每条曲线的位置和宽度。然后,通过利用基于CLIP特…
