模型框架
-
谷歌Vids神器🎬 | 文字秒变视频,视频制作从未如此简单!
视频制作爱好者,你们的福音来了!谷歌AI视频制作神器Vids,输入文字就能秒变视频,让视频制作过程变得前所未有的简单和高效! 🚀【智能视频草稿】Vids能够自动生成视频草稿,包含场景、脚本、推荐媒体素材和背景音乐。你只需输入文字,Vids就能帮你完成视频制作的初步构思,大大简化了制作过程。 🎤【语音和录音功能】Vids支持便捷的语音和录音功能,包括AI语音旁白和滚动式提词器。这…
-
CHANGER换头技术来袭🔄 | 无缝合成,打造你的专属头像!
各位数字内容创作者和摄影爱好者,是时候展现真正的技术了!CHANGER换头技术,一种新型头部融合管道,专为解决头部合成问题而生,让你的参考头像照片与目标身体无缝集成,开启全新的创作体验! 🎭【头部合成革命】CHANGER技术的问世,为数字内容创作带来了革命性的变化。它通过先进的算法,实现了头部与身体的无缝融合,无论是角度、光线还是背景,都能完美匹配。 📸【无缝集成】使用CHAN…
-
Meissonic图像生成革命🌪️ | 10亿参数,1024×1024高清大图轻松造!
科技前沿的小伙伴们,准备好迎接Meissonic带来的图像生成新纪元了吗?这款颠覆性的图像生成模型,通过一系列架构创新和优化策略,将非自回归掩码图像建模技术推向了新的高度! 🚀【架构创新】Meissonic的创新之处在于其独特的架构设计,它不仅能够与顶级扩散模型相媲美,更在性能和效率上实现了质的飞跃。这标志着图像生成技术的又一大突破。 🎨【高质量图像】仅需10亿参数,Meiss…
-
阿里通义千问开源新动作🌟 Qwen2.5-Coder全系列模型来袭!
技术控和开发者们,注意啦!阿里通义千问今天宣布开源Qwen2.5-Coder全系列模型,这可是编程界的大新闻!🚀💻 🌐【开源共享】 阿里通义千问的这一开源举措,意味着更多的开发者可以访问和使用Qwen2.5-Coder模型,共同推动技术的进步和创新。 🔧【模型特性】 Qwen2.5-Coder系列模型专为编程而生,它能够理解代码逻辑,提供智能的代码补全和错误检测,是开发者的得力…
-
Fashion-VDM:一键试衣,视频见证你的时尚变身!👗📹
亲爱的时尚达人们,想要快速预览穿上心仪衣物的效果吗?Fashion-VDM来帮你实现这个愿望!只需一张图+视频,就能展示穿上输入衣物后的神奇效果,让你的穿搭选择更简单、更直观! 👚【时尚新体验】 Fashion-VDM技术,让你在选择衣物时不再犹豫。只需上传一张你的照片和想要试穿的衣物图片,系统就能生成一段视频,展示你穿上这件衣物的样子,让你在购买前就能预见穿搭效果。 📱【操作…
-
可一键生成“多机位”视频大片-ReCapture
利用多视角扩散模型和遮罩视频微调技术,实现粗略视频到清晰、连贯、动感视频的转变。适用于各种视频和视角转换,让普通用户也能制作专业级“多机位”视频。 项目地址: https://generative-video-camera-controls.github.io
-
字节推出单图视频驱动模型 X-Portrait 2
即只需一张静态照片和一段驱动视频,即可生成高质量、“电影级”的视频。可一键生成相同表情神态。 字节跳动推出的单图视频驱动模型 X-Portrait 2 是一项革命性的技术,它能够基于一张静态照片和一段驱动视频生成高质量、电影级别的视频。以下是 X-Portrait 2 的一些主要功能和特点: X-Portrait 2 的问世,为视频创作领域带来了新的突破,使得仅凭一张静态图片和…
-
FLUX.1-dev LoRA秒出服装效果图
FLUX.1-dev LoRA 是由 TryOn Labs 开发的一款服装生成器,它利用先进的人工智能技术,能够根据用户输入的服装描述(包括颜色、图案、材质、风格等细节)快速生成相应的服装设计图。这款工具的强大之处在于其灵活的输入格式和丰富的时尚知识库,使得用户可以充分发挥创意,描述出心目中的理想服装。 例如,如果用户输入“一件森林绿色缎面连身裤,宽腿,金色植物印花,系着米白色…
-
腾讯混元-3D: 首个同时支持 文生和图生的3D开源模型
腾讯发布了开源的 3D 生成模型。这个模型是第一个能够同时支持通过文字生成 3D 以及通过图片生成 3D 的开源模型。用户可以上传一张照片,通过这个模型生成 3D 模型,进而可以进行 3D 打印。并且展望未来,通过这个模型有望实现玩具自由,即可以轻松制作各种玩具。 为了解决现有的3D生成模型在生成速度和泛化能力上存在不足,我们开源了混元3D-1.0模型,可以帮助3D创作者和艺术…
-
腾讯混元又开源了两个重磅模型:混元Large和Hunyuan3D-1.0
腾讯混元 Large 模型与腾讯混元 Pro、腾讯混元 Turbo 等不同尺寸模型源于同一技术体系,在腾讯内部近 700 个业务和场景中广泛应用,如腾讯元宝、微信公众号等。该模型总参数量为 389B,激活参数量 52B,上下文长度达 256K,采用主流的 MoE 架构模型,推理成本远低于同等参数稠密模型,在多学科综合评测集及 9 大维度中全面领先。已同步上架腾讯云 TI 平台,…
