模型框架

  • Meta发布首款AI模型Muse Spark,千亿美金预算加速超级智能布局

    核心看点 🧠 Meta发布首款自研高性能AI模型Muse Spark,超级智能布局迈出实质一步 💰 2026年Meta AI支出预计达1150亿-1350亿美元,远超2025年的722亿 🌐 Muse Spark具备多模态感知与复杂推理能力,全面对标Gemini Deep Think与GPT Pro Meta正式发布首款自研高性能AI模型Muse Spark,标志着扎克伯格在千…

    模型框架 2026年4月11日
  • 国产AI大模型GLM-5.1登顶开源第一:可独立编程8小时

    核心看点 🏆 GLM-5.1登顶LMArena Code Arena全球开源模型榜首,位列全球第三 💻 编程评分45.3分,与最强Opus 4.6仅差2.6分 ⏱️ 唯一实现8小时持续工作的开源模型,SWE-bench Pro刷新全球最佳成绩 智谱AI旗下开源大模型GLM-5.1正式发布后,迅速在开发者圈引爆热潮。最新的全球权威AI评测平台LMArena(百万用户盲测)Code…

    模型框架 2026年4月11日
  • 字节跳动发布全双工语音大模型Seeduplex:打电话能边听边讲

    4月9日,字节跳动正式推出原生全双工语音大模型 Seeduplex,并已在豆包 App 全量落地。这也是行业内首个规模化应用的全双工语音大模型。 核心看点 打破传统 AI 语音”一问一答”的半双工模式,实现真正的边听边说 误回复率和误打断率相比半双工模型减少一半 抢话比例下降 40%,对话节奏更接近真人交流 对话流畅度 MOS 分提升 12%,整体通话满…

    模型框架 2026年4月11日
  • 智元GO-2具身大模型发布:让机器人首次实现”知行合一”

    4月9日,智元机器人正式发布新一代具身基座大模型 Genie Operator-2(GO-2)。这款模型瞄准的是机器人领域最顽固的痛点——机器人能”听懂”指令、能”规划”任务,但真正动手执行时却总是差那么一点。 核心看点 首创”动作思维链”机制,让机器人在动作空间里先思考、再执行,实现真正的知行合一 采用异…

    模型框架 2026年4月11日
  • 智元发布具身基座大模型GO-2:让机器人真正”知行合一”

    核心看点 🤖 GO-2引入”动作思维链”机制,让机器人”想清楚再做” ⚡ 首创异步双系统架构,高频执行匹配低层规划 🏆 在多个机器人基准测试中刷新SOTA成绩 4月9日,智元机器人正式发布新一代具身基座大模型Genie Operator-2(简称GO-2)。该模型旨在解决机器人从”理解意图”到”…

    模型框架 2026年4月10日
  • 阿里黑科技炸场!0.6B 小模型”魔改”成 17B MoE,激活参数仅 5%,CPU 直接跑 30token/s

    阿里国际数字商业团队推出重磅研究成果——Marco-Mini-Instruct模型,通过一项名为Upcycling的技术,将仅有0.6B参数的小模型”魔改”成拥有17B参数总量的MoE(混合专家)架构,而实际激活参数仅0.86B,推理效率极高,甚至可以在普通CPU上跑到30token/s,极大降低了本地部署门槛。 【AiBase提要】 🧠 通过Upcyc…

    模型框架 2026年4月10日
  • 阿里 HappyHorse 模型横空出世:AI视频生成登顶全球第一

    4月10日,阿里官方正式”认领”了此前在AI视频领域引发轰动的神秘模型HappyHorse。 据悉,该模型由阿里ATH创新事业部独立研发,主打原生音视频一体化生成、多语言唇形同步等核心能力。根据第三方权威评测,HappyHorse已在文生视频和图生视频双赛道超越Seedance等头部竞品,跃居全球第一。 核心能力解析 原生音视频一体化:告别传统先生成视频…

    模型框架 2026年4月10日
  • 消息称软银寻求 400 亿美元贷款投资 OpenAI,规模创纪录

    今天分享一则来自IT之家的AI行业动态。 📰 模型框架 消息称软银寻求 400 亿美元贷款投资 OpenAI,规模创纪录 这是一篇关于AI领域的最新资讯,值得关注。 🔗 点击阅读原文 本文由 AI 自动整理生成,内容仅供参考。来源: IT之家

    2026年3月7日
  • Inception Labs 开发的一款基于扩散技术的大型语言模型(dLLM)- Mercury Coder,这玩意儿太快了……

    技术特点 Mercury Coder 是由 Inception Labs 开发的一款基于扩散技术的大型语言模型(dLLM),专为高效编程和文本生成设计。 性能表现 应用场景 优势总结 Mercury Coder 的主要优势在于其极高的生成速度和并行处理能力,同时保持了与传统模型相当的性能。它还具备纠错能力,能够生成更准确的文本和代码。 体验地址: https://chat.in…

    2025年3月8日
  • DeepSeek发布Janus-Pro多模态大模型,进军文生图领域

    在一些基准测试中,Janus-Pro-7B 击败了 OpenAI 的 DALL-E 3 以及 Stable Diffusion、Emu3-Gen 等热门模型。Janus Pro 采用 MIT 开源协议,可无限制用于商业场景。并且该大模型是 2024 年 11 月 13 日发布的 JanusFlow 大模型的高级版本。(暂时只能处理384×384分辨率的图像) 模型地址…

    2025年1月28日