模型框架

  • 视频虚拟试穿的框架:ViViD,解决视频虚拟试穿的问题

    可以合成自然、逼真的视频,保留目标服装的身份,同时保持源视频其余部分不变 项目地址: https://github.com/novitalabs/AnimateAnyone 论文地址: https://arxiv.org/pdf/2405.11794 这篇论文介绍了一种名为ViViD的视频虚拟试穿技术,通过强大的扩散模型来实现视频虚拟试穿。他们提出了一种新的架构,利用扩散模型生…

    2024年5月31日
  • Mistral发布首个用于编码的生成式人工智能模型—Codestral,支持 Python 等 80 多种语言

    法国人工智能初创公司Mistral发布了Codestral,这是一个用于编码的生成式人工智能模型,支持多种编程语言。虽然模型在一些测试中表现优异,但其实际价值和可靠性仍有待观察。其他研究指出,AI开发工具可能导致错误代码被提交,而一些AI模型在编程问题上的回答存在错误。Mistral计划将Codestral整合到多个应用框架和开发环境中。 Codestral 可以熟练使用 80…

    2024年5月30日
  • 多语言手语模型SignLLM,AI可以生成手语手势视频了

    SignLLM是一项创新的多语言手语模型,为听力障碍者提供了重要的沟通工具,推动了人工智能在语言理解和生成领域的研究。它通过文字描述生成手语视频,促进信息的无障碍交流。 项目地址: https://signllm.github.io/

    2024年5月28日
  • Open-Sora 1.1发布,视频质量提升,生成时长延长至21秒

    Open-Sora1.1发布带来了显著提升,尤其在视频生成质量和时长方面。新版本模型能生成最长约21秒视频,使用高质量视觉数据和字幕训练,提升对世界运作的理解。CausalVideoVAE架构优化提高性能和推理效率。 项目地址: https://github.com/PKU-YuanGroup/Open-Sora-Plan

    2024年5月28日
  • 通过区域性图像编码来提升多模态大模型的感知定位能力:Groma

    Groma,这是一个具有视觉感知能力的多模态大型语言模型。Groma能够理解用户指定的区域输入,并将文本输出与图像联系起来。通过将区域标记集成到用户指令和模型响应中,Groma展现出在标准指代和定位基准测试中优越的性能。它是一个具有出色区域理解和视觉定位能力的多模态大型语言模型。 核心思路是将定位任务转移到多模态大模型的vision tokenizer中,利用其空间理解能力定位…

    2024年5月27日
  • ReVideo:AI视频编辑新方法可局部修改视频内容和运动轨迹

    一种名为ReVideo的视频编辑方法,通过指定内容和运动来实现精确的视频编辑。通过三阶段的训练策略和时空自适应融合模块,实现了内容和运动控制的集成,具有出色的编辑效果。这种方法可以在特定区域进行精确的视频编辑,包括修改内容和运动轨迹。 项目地址: https://mc-e.github.io/project/ReVideo/

    2024年5月25日
  • 腾讯混元大模型全面降价,混元-lite 模型调整为全面免费

    今天,腾讯云公布全新大模型价格方案,其中主力模型之一混元-lite 模型,API 输入输出总长度计划从目前的 4k 升级到 256k,价格从 0.008 元 / 千 tokens 调整为全面免费。 混元-standard API 输入价格从 0.01 元 / 千 tokens 降至 0.0045 元 / 千 tokens ,下降 55%,API 输出价格从 0.01 元 / 千…

    2024年5月23日
  • 百川智能发布最新一代基座大模型 Baichuan 4

    据官方介绍,Baichuan 4 相较 Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过 10%,数学和代码能力分别提升 14% 和 9%,在国内权威大模型评测机构 SuperCLUE 的评测中,模型能力国内第一。 地址: https://platform.baichuan-ai.com/homePage 工具调用支持自定义工具调用,助力企业复杂场景支持对接…

    2024年5月22日
  • 中国大模型头名易主:全球盲测榜单上,Yi-Large与GPT-4o中文并列第一

    中国大模型头名易主:全球盲测榜单上,Yi-Large与GPT-4o中文并列第一中国大模型头名易主:全球盲测榜单上,Yi-Large与GPT-4o中文并列第一中国大模型头名易主:全球盲测榜单上,Yi-Large与GPT-4o中文并列第一中国大模型头名易主:全球盲测榜单上,Yi-Large与GPT-4o中文并列第一

    机器之心发布 机器之心编辑部 上周,一个名为 “im-also-a-good-gpt2-chatbot” 的神秘模型突然现身大模型竞技场 Chatbot Arena,排名直接超过 GPT-4-Turbo、Gemini 1 .5 Pro、Claude 3 0pus、Llama-3-70b 等各家国际大厂的当家基座模型。随后 OpenAI 揭开 “im-also-a-good-gp…

    2024年5月21日 模型框架
  • AWPortrait 1.4 正式发布,人物肖像效果炸裂

      AWPortrait终于迎来了1.4,将SD1.5人像的真实感提升到了一个新的高度,增加了旗袍、汉服等东方元素,更好的棚拍效果及户外效果,可更改人物年龄,比较稳定的输出效果是10-80岁。 模型地址(1.99G): https://www.liblib.art/modelinfo/721fa2d298b262d7c08f0337ebfe58f8

    2024年5月3日