开源项目
-
全景图像生成新方法PanoFree
全文总结本文主要介绍了一种名为 PanoFree 的新型无调优多视图图像生成方法,该方法在沉浸式场景生成,特别是全景图创建方面具有显著优势。重要亮点 项目地址: https://panofree.github.io
-
苹果发布了一种新的图像和视频生成方法Matryoshka Diffusion Models (MDM)
全文总结本文主要介绍了一种名为 Matryoshka Diffusion Models(MDM)的端到端框架,用于高分辨率图像和视频合成。指出扩散模型在生成高质量图像和视频方面表现出色,但在高维空间学习存在挑战,现有方法常采用训练级联模型,而本文提出的 MDM 采用多尺度联合扩散过程,小尺度模型嵌套在大尺度内,促进了特征共享和架构的渐进式增长,在多个基准上展示了有效性,包括 I…
-
Qwen2-Math 开源 AI 模型发布,基于 Qwen2 LLM 构建、专门用于数学解题的语言模型
全文总结这段文本主要介绍了多个数学问题及相应的求解过程,包括关于 Qwen2–Math 系列模型在数学推理能力方面的表现和评估,以及一系列不同类型的数学函数问题的求解。重要亮点 求解方法与思路:在解决问题时,通常先进行条件分析和代入特定值,然后探索规律、假设函数形式并进行验证,以得出最终结论。 Qwen2-Math 模型介绍:Qwen2-Math 是基于 Qwen2…
-
创新的头发转移技术:Stable-Hair,适合做发型设计
解决了传统方法无法处理复杂发型的问题,为用户带来全新的试发体验。 地址: https://github.com/Xiaojiu-z/Stable-Hair
-
一款适合时尚爱好者使用的小型AI虚拟换衣模型:CatVTON
参数小仅899.06M,支持高分辨率,支持在ComfyUI和Gradio应用上部署,操作便捷。 地址: https://github.com/Zheng-Chong/CatVTON
-
全新的图像生成模型 FLUX.1来了
新公司名叫 Black Forest Lab,黑森林实验室。宣布推出全新的图像生成模型 FLUX.1。FLUX.1 包含专业版、开发者版、快速版三种模型,其中前两款模型击败 SD3-Ultra 等主流模型,较小规模的 FLUX.1 [schnell] 也超越了 Midjourney v6.0、DALL・E 3 等更大的模型。 体验地址: https://replicate.co…
-
AI生成3D新框架TexGen
由阿尔伯塔大学、多伦多大学和华为诺亚方舟实验室联合推出的新技术,能够根据用户的文本描述生成高质量的3D纹理,解决了传统方法中的接缝和过度平滑问题。 https://dong-huo.github.io/TexGen
-
阿里巴巴的研究团队推出了基于轨迹的视频生成新模型Tora
Tora以高保真度、精准运动控制和多样化输入著称,采用先进的Diffusion Transformer架构,突破视频生成限制,实现60秒高质量视频生成。 项目地址: https://ali-videoai.github.io/tora_video
-
智谱 AI 将与“清影”同源的视频生成模型 ——CogVideoX 开源
重要亮点 项目地址: https://github.com/THUDM/CogVideo
-
以即插即用方式控制全身多模态运动生成的统一框架 ControlMM
本文主要探讨了全身多模态运动生成的相关内容,指出其在视频生成和角色动画等方面有诸多应用,但在统一模型完成不同条件模态的生成任务时面临运动分布漂移、混合条件优化复杂以及现有数据集运动格式不一致等挑战。为此,提出了以即插即用方式控制全身多模态运动生成的统一框架 ControlMM。重要亮点 实验效果:大量实验表明 ControlMM 在各种标准运动生成任务中达到了最先进的性能。 面…
