开源项目
-
Motion-I2V :可以让开源视频模型也有类似 Runway 的运动笔刷能力
昨天清华大学和商汤公司的这个视频生成项目可以让开源视频模型也具备类似Runway的运动笔刷能力。而且比Runway更进一步,支持在涂抹区域后使用画笔描绘运动方向,也可以分开使用。 希望可以与现有的开源视频生成模型兼容,我在论文中没有看到相关内容。 详细介绍: 我们推出了一种名为Motion-I2V的创新框架,用于实现一致且可控的图片到视频转换(I2V)。与以往直接学习复杂映射关…
-
只需要100美金,就能手搓一个Humane Pin
ADeus是一个人工智能可穿戴设备项目,所有零件都可以在网上购买,代码也是开源的。 它能够实时记录和保存语音和环境数据,并通过手机或电脑上的应用进行访问。你可以与它聊天,并询问它关于你的任何记录信息。 主要功能和特点包括: 1. 数据记录和处理:它可以实时记录你的声音和其他数据,并发送到网络上的一个服务进行处理。 2. 个人助手:通过手机或电脑上的应用,你可以与它聊天,就像与朋…
-
智能 AI 照片生成器EasyPhoto,用于生成AI肖像画,创作数字分身
EasyPhoto是一个Webui UI插件,用于生成AI肖像画。这段代码可以用来训练与您相关的数字分身。建议使用5到20张肖像图片进行训练,最好是半身照片,并且最好不要佩戴眼镜(少量可以接受)。一旦训练完成,我们可以在推理部分生成图像。我们支持使用预设模板图片或上传自己的图片进行推理。 点击上传按钮后,我们可以开始上传图片。建议上传5到20张图片,包括不同的角度和光照条件。最…
-
一个界面非常简洁美观功能强大的的开源知识库程序:Outline
Outline是一个快速、协作的团队知识库,界面美观,功能强大,兼容Markdown。 它适用于各种文档和知识管理需求。 Outline是一个直观、快速且协作的文档编辑和管理平台,具有以下特点: – 直观的编辑体验:提供了一个快速编辑器,支持Markdown、斜线命令、互动嵌入等功能。 – 实时协作:支持团队成员在文档上实时协作,评论和线程帮助组织对话。…
-
1分钟语音即可训练一个自己的TTS模型:GPT-SoVITS
GPT-SoVITS是一个声音克隆和文本到语音转换的开源 Python RAG框架。 只需5秒的数据,它就可以模仿你的声音,只需1分钟的声音数据,就可以训练出一个高质量的TTS模型,完美克隆你的声音! 根据演示来看,它似乎是目前中文支持比较好的模型。 界面也很易用。 主要特点包括: 1. 零样本TTS:只需5秒的声音样本即可体验即时的文本到语音转换。 2. 少量样本训练:只需1…
-
Vanna是一个帮助用户更容易地与SQL数据库交互的工具
它允许用户用自然语言来询问数据库,然后它会自动把这些话转换成SQL语句,去数据库里找到相应的数据。 这对于不太懂SQL语言的人来说非常方便,因为他们可以像跟人聊天一样跟数据库“聊天”,获取他们需要的信息。 Vanna主要功能特点: Vanna基于开源Python框架,使用检索增强生成(RAG)技术进行SQL生成和相关功能。其主要特点是通过与SQL数据库的交互,准确地通过大型语言…
-
Stability AI发布 Stable Code 3B模型,专门用于辅助编程
它可以在普通的笔记本电脑上运行,甚至包括那些没有专用GPU的型号,如MacBook Air。 相较于其前身CodeLLaMA 7b,体积减少了60%,但在多种编程语言上保持了同等的性能。 支持18种编程语言,上下文大小100K… 性能和特点: 1、体积小效率高: 相较于其前身CodeLLaMA 7b,虽然体积减少了60%,但在多种编程语言上保持了类似的高级性能。 2…
-
阿里巴巴的新项目 MotionShop:将视频中的角色替换为3D化身
通过先进的视频处理和3D渲染技术,MotionShop能够高效地将视频中的某个角色替换为3D人物,同时不改变视频中的其他场景和人物。 被替换的3D人物能完整复刻原视频中人物的动作,保持动作一致。 MotionShop的技术原理: 1、视频处理和背景提取: 利用视频处理技术,从原始视频中分离出人物,留下无人的背景。这一步涉及复杂的图像分析和处理,以确保背景的完整性和连贯性。 角色…
-
照片级、真实感的图像着色工具DDColor,能实现高度真实的图像上色效果。
使用双解码器技术,DDColor能够同时考虑色彩分布和像素级详细信息,能实现高度真实的图像上色效果。 不仅能给历史黑白照片上色,还能对动漫或游戏中的风景进行真实风格的上色。 将动画场景转化为现实生活风格。 DDColor使用了双解码器来处理图片:一个是恢复图片的结构,另一个是决定图片每个部分的颜色。 这项技术的创新之处在于它不需要像以前的方法那样依赖于人工设置的规则,而是能够自…
-
一个利用多张照片作为身份ID的工具:PhotoMaker,可以根据描述生成符合描述的人物照片
PhotoMaker是一个利用多张照片作为身份ID的工具,可以根据描述生成符合描述的人物照片,并且能够将不同人的照片特征混合在一起,创造出全新的人物形象。此外,它还可以改变照片人物的性别、年龄,并生成多种风格的其他照片。PhotoMaker的效果快速逼真,效果自然。 PhotoMaker是一种使用”堆叠ID嵌入”技术的图像生成工具。它可以结合多张照片的特…
