模型框架
-
Stability AI 推出 SPAR3D,能够在不到一秒的时间内从单个图像中生成精确的3D对象
Stability AI 在2025年1月9日的CES展会上宣布推出了一种名为SPAR3D(Stable Point Aware 3D)的创新3D生成技术。SPAR3D是一种两阶段的3D生成方法,能够在不到一秒的时间内从单个图像中生成精确的3D对象,并支持实时编辑功能。这项技术为游戏开发者、产品设计师和环境构建者提供了全新的3D原型设计方式。 SPAR3D的主要功能和特点 技术…
-
微软开源 140 亿参数小语言 AI 模型 Phi-4
微软于2025年1月8日在Hugging Face平台上开源了其小型语言模型Phi-4。Phi-4是微软2023年推出的小型语言模型系列的第四代产品,拥有140亿参数。该模型基于Transformer架构,采用仅解码器型架构,只关注单词之前的文本,减少了需要处理的数据量,从而降低了推理成本。 Phi-4在多个基准测试中表现优异,甚至超越了参数量更大的Llama 3.3 70B和…
-
See3D 模型:能够利用无标注互联网视频进行3D 生成的模型
北京智源人工智能研究院推出的See3D模型是一项创新的技术,它能够利用无标注的互联网视频进行3D内容的生成。以下是See3D模型的一些关键特点: See3D模型的推出为3D生成领域带来了新的可能性,特别是在降低成本和提高效率方面,它为3D数据的采集和应用提供了一种新的解决方案。 项目地址: https://vision.baai.ac.cn/see3d
-
一个端到端的社会视觉-语言-动作建模框架
根据您的请求,以下是关于端到端的社会视觉-语言-动作建模框架SOLAMI的详细介绍: SOLAMI的推出标志着视觉-语言-动作模型在社会交互领域的新进展,为3D自主角色的社交智能提供了新的解决方案。 项目地址: https://solami-ai.github.io
-
智谱AI上线免费多模态模型GLM-4V-Flash
智谱AI最近推出了其首个免费的多模态模型——GLM-4V-Flash,这是一个重要的里程碑,标志着AI技术在多模态领域的进一步普及和应用。以下是GLM-4V-Flash的一些关键特点和功能: 智谱AI的GLM-4V-Flash模型的上线,无疑为AI领域带来了新的可能性,特别是在图像理解和多模态交互方面。 体验地址: https://www.bigmodel.cn/console…
-
DeepSeek AI 发布新版 DeepSeek-V2.5-1210
DeepSeek AI 最近发布了其 DeepSeek V2 系列的最终版微调模型——DeepSeek-V2.5-1210。以下是该版本的主要特点和功能: 这些更新使得 DeepSeek-V2.5-1210 成为一个在多个领域都具有强大性能的 AI 模型,为用户提供了更加全面和高效的服务。 地址: https://huggingface.co/deepseek-ai/DeepS…
-
Adobe联手MIT打造CausVid视频生成模型
Adobe与MIT合作推出的CausVid视频生成模型是一项突破性技术,它能够实现实时视频生成,极大地提升了视频内容创作的效率。以下是CausVid的一些关键特性: CausVid的出现标志着视频生成领域的一次重大突破,它将彻底改变我们创作和消费视频内容的方式,开启一个充满无限可能性的未来。 项目地址: https://causvid.github.io
-
MMAudio:输入视频或文本可自动给视频配音效
MMAudio是一项由伊利诺伊大学厄巴纳-香槟分校、Sony AI及Sony集团联合推出的新技术,它能够实现视频到音频的高质量合成。这项技术的核心创新在于利用视频和文本输入生成同步音频,从而拓展了音频生成的应用场景。MMAudio的设计使其能够在各种视听和音频文本数据集上进行训练,这种多模态联合训练的方式,不仅提高了合成音频的质量,还确保了生成的音频与视频帧之间的同步。 MMA…
-
谷歌已经正式发布了新一代的AI模型Gemini 2.0
谷歌已经正式发布了新一代的AI模型Gemini 2.0,这标志着谷歌在人工智能领域的又一重大进展。以下是Gemini 2.0的一些关键特性和亮点: Gemini 2.0的发布,展示了谷歌在构建更智能、更自动化的AI代理方面的雄心,这些代理能够理解环境、执行任务并在一定程度上独立做出决策。这不仅是技术上的一次飞跃,也为用户带来了更加丰富和便捷的智能体验。
-
Exo Labs来袭!让Mac M4电脑也能本地运行强大开源AI模型
家人们,好消息!Exo Labs带着他们的黑科技来了,现在你的Mac M4电脑也能变身强大的本地AI模型运行器啦!🌌 🍎【Apple M4芯片的力量】 Exo Labs利用Apple M4芯片,在本地计算集群上成功运行开源AI模型,这意味着我们可以告别昂贵的NVIDIA GPU,用我们手头的设备就能搞定! 💼【成本与隐私】 本地运行AI模型不仅降低了成本,还提高了隐私安全,再也…
