模型框架
-
Google研究团队开发了一种名为TimesFM的时间序列预测模型
时间序列预测是利用过去的数据来预测未来事件的发生。这在商业、金融和科研等多个领域都非常重要,可以帮助人们做出更明智的决策。例如,商家可以利用时间序列预测来预测未来产品需求,金融分析师可以用来预测股市的变动,甚至可以用来预测天气。 举个例子来解释,假设你经营着一家小型零售店,你希望能够预测接下来一个月每天的顾客流量,这样就可以更好地管理库存,安排员工的工作班次,甚至…
-
北大的开源项目MoE-LLaVA:多模态的混合专家模型
MoE-LLaVA:多模态的混合专家模型 北大的开源项目,3B的资源占用,媲美7B的能力。 只有3B个稀疏激活参数,与LLaVA-1.5-7B在各种视觉数据集上表现相当,在物体幻觉基准测试中超越了LLaVA-1.5-13B。 论文地址: https://arxiv.org/pdf/2401.15947.pdf 在线体验: https://huggingface.co/space…
-
商汤大模型体系日日新SenseNova 4.0发布,其知识覆盖面、推理能力、长文本理解力、代码生成能力等得到提升
地址: https://platform.sensenova.cn/ 据商汤科技微信公众号发文,今日,商汤大模型体系日日新SenseNova 4.0发布,其知识覆盖面、推理能力、长文本理解力、代码生成能力等得到提升。其中,日日新·商量大语言模型-通用版本(SenseChat V4)支持128K语境窗口长度,综合整体评测成绩水平比肩GPT-4,相较GPT-3.5已经实现全⾯超越。…
-
阿里发布手机操作智能体框架Mobile-Agent
1月30日,来自阿里和北京交通大学的团队在arXiv上发表论文,提出了用于操作手机的智能体框架Mobile-Agent。据介绍,这是一个纯视觉解决方案,不需要XML(可拓展标记语言)和系统元数据,其操作范围不受限制,可进行多应用操作,配备多种视觉感知工具用于操作定位,且无需训练,即插即用。目前,Mobile-Agent已经学会了阿里巴巴、谷歌地图、TikTok等10个APP的操…
-
谷歌最新文生图小型模型:MobileDiffusion
文本到图像扩散模型在移动设备上的应用一直面临着效率低下的问题,但是《MobileDiffusion:移动设备上亚秒级文本到图像生成》提出了一种新的方法,可以在设备上快速生成高质量图像。MobileDiffusion是一种高效的潜在扩散模型,模型大小较小,适合移动部署。通过采用DiffusionGAN进行一步采样,可以进一步提高效率。该研究为移动设备上的文本到图像生成提供了新的解…
-
百川智能发布超千亿大模型Baichuan 3,宣称中文评测超越GPT-4
1月29日,百川智能发布超千亿参数的大语言模型Baichuan 3。在多个权威通用能力评测如CMMLU、GAOKAO和AGI-Eval中,Baichuan 3都展现了出色的能力,尤其在中文任务上更是超越了GPT-4。而在数学和代码专项评测如MATH、HumanEval和MBPP中同样表现出色,证明了Baichuan 3在自然语言处理和代码生成领域的强大实力。 不仅如此,其在对逻…
-
1分钟语音即可训练一个自己的TTS模型:GPT-SoVITS
GPT-SoVITS是一个声音克隆和文本到语音转换的开源 Python RAG框架。 只需5秒的数据,它就可以模仿你的声音,只需1分钟的声音数据,就可以训练出一个高质量的TTS模型,完美克隆你的声音! 根据演示来看,它似乎是目前中文支持比较好的模型。 界面也很易用。 主要特点包括: 1. 零样本TTS:只需5秒的声音样本即可体验即时的文本到语音转换。 2. 少量样本训练:只需1…
-
智谱AI发布新一代模型:GLM-4
GLM-4支持更长的上下文,具备更强的多模态能力。同时,它的推理速度更快,支持更高的并发。性能相较GLM-3 提升 60%。 智谱AI还推出了GLMs,类似GPTs的东西,并发布 GLM-4-All Tools。 智谱AI CEO张鹏表示,国内研发的大模型与世界先进水平差距约一年,但已逼近GPT-4性能。 GLM-4 All Tools能实现自主根据用户意图,自动理解、规划复杂…
-
Stability AI发布 Stable Code 3B模型,专门用于辅助编程
它可以在普通的笔记本电脑上运行,甚至包括那些没有专用GPU的型号,如MacBook Air。 相较于其前身CodeLLaMA 7b,体积减少了60%,但在多种编程语言上保持了同等的性能。 支持18种编程语言,上下文大小100K… 性能和特点: 1、体积小效率高: 相较于其前身CodeLLaMA 7b,虽然体积减少了60%,但在多种编程语言上保持了类似的高级性能。 2…
-
阿里巴巴的新项目 MotionShop:将视频中的角色替换为3D化身
通过先进的视频处理和3D渲染技术,MotionShop能够高效地将视频中的某个角色替换为3D人物,同时不改变视频中的其他场景和人物。 被替换的3D人物能完整复刻原视频中人物的动作,保持动作一致。 MotionShop的技术原理: 1、视频处理和背景提取: 利用视频处理技术,从原始视频中分离出人物,留下无人的背景。这一步涉及复杂的图像分析和处理,以确保背景的完整性和连贯性。 角色…
