模型框架

  • Hermes Agent v0.14.0 发布:pip一键安装,三大模型OAuth直通,22平台全覆盖

    核心看点 pip install hermes-agent 一步到位,安装体积大幅缩减,按需加载后端 Claude Pro / ChatGPT Pro / SuperGrok OAuth 登录后本地代理为 OpenAI 兼容 API,Codex/Aider/Cline 无需 API key 直接调用 xAI Grok 正式入驻,grok-4.3 支持 1M 上下文窗口 冷启动提…

    模型框架 2026年5月18日
  • MiniMax Agent 正式更名 Mavis,推出多智能体协作功能

    <p>MiniMax 把旗下 Agent 产品升级并正式更名为 Mavis,同时还推出了一个很有意思的功能——Agent Teams。简单说,就是多个 AI 智能体可以一起干活了,像一个真正的团队一样协同工作。</p><p>为什么需要多智能体协作?因为单个 AI 的局限性很明显。你让一个 AI 同时做三件事,它可能每件事都做得一般,而且容易顾…

    模型框架 2026年5月14日
  • 阶跃StepAudio 2.5 TTS登顶全球前三,中国大模型语音合成冲进第一梯队

    阶跃星辰的StepAudio 2.5 TTS模型在Artificial Analysis Speech Arena的全球盲测榜单中位列前三。这个榜可不是随便排的——它用的是Elo评分机制,让真实用户盲听对比,拼的是”听起来像不像人”。 核心看点 StepAudio 2.5 TTS在Speech Arena Leaderboard全球前三 采用盲测Elo评…

    模型框架 2026年5月11日
  • 百度文心大模型5.1正式发布:自研技术仅6%成本实现业界领先,LMArena搜索榜国内第一

    核心看点 百度发布文心大模型5.1,采用自研多维弹性预训练技术,预训练成本仅为业界同规模模型的6% 在LMArena搜索榜以1223分位列国内第一、全球第四,智能体能力超越DeepSeek-V4-Pro 模型参数压缩至文心5.0的三分之一,激活参数压缩至约二分之一,基础能力全面领先 百度今天正式发布了新一代基础大模型——文心大模型5.1。这次发布的看点不止是性能提升,更在于成本…

    模型框架 2026年5月9日
  • OpenAI推出GPT-5.5-Cyber预览版:给安全团队开{LQ}后门{RQ},专门干黑客的活

    OpenAI最近推出了一个很有意思的预览版模型——GPT-5.5-Cyber,专门面向网络安全团队开放。这个模型的特别之处在于:它在安全任务上{RQ}放宽了限制{RQ},让授权的安全团队能更高效地执行漏洞识别和恶意软件分析。 为什么要{LQ}放宽限制{RQ}?这里有个行业痛点。通用版的大模型在设计时会加入很多安全机制,防止模型被用来生成恶意代码或进行网络攻击。这本身是对的,但对…

    模型框架 2026年5月8日
  • 字节跳动发布全模态大模型Doubao-Seed-2.0-lite:能听会看还会动手操作电脑

    字节跳动又放大招了!旗下火山引擎正式发布了全模态大模型 Doubao-Seed-2.0-lite。什么叫{LQ}全模态{RQ}?简单说就是,这个模型能同时理解视频、图像、音频和文字,不再像以前的模型那样只能处理单一类型的信息。 打个比方,以前的AI模型可能只能看文字或者只能看图片,但Doubao-Seed-2.0-lite可以一边听你说话、一边看着你给的视频画面、一边理解文字内…

    模型框架 2026年5月8日
  • 蚂蚁开源万亿参数大模型Ling-2.6-1T,代码能力和推理干到开源顶尖

    【核心看点】• 蚂蚁集团正式开源万亿级大模型Ling-2.6-1T,采用创新混合架构• 在代码生成、缺陷修复、噪声环境下的精准推理方面达到开源领域顶尖水平• 可适配多工具、多约束的复杂业务场景,展现强大多步执行能力 【详细解析】 蚂蚁集团近日在Hugging Face上正式开源了万亿参数级大模型Ling-2.6-1T,这是国内金融科技巨头在AI基础模型领域的一次重磅出击。 Li…

    模型框架 2026年5月2日
  • DeepSeek灰度上线识图模式,多模态能力正式落地

    【核心看点】· DeepSeek在网页端和App端灰度测试”识图模式”,填补多模态能力空白· 该模式作为独立一级入口,与快速、专家模式并列,定位为核心能力· 目前开放图片理解能力,涵盖视觉问答、截图分析等场景 【详细解析】4月29日,DeepSeek开始灰度测试”识图模式”,标志着这家在中国AI圈风头正劲的公司,终于补齐了多模态这…

    模型框架 2026年5月1日
  • 文心一言5.1预览版上线LMSYS国际盲测,目前位列全球第13位

    核心看点 • 文心一言5.1预览版低调上线 LMSYS Chatbot Arena 国际盲测平台• 目前位列全球第13位,表现可圈可点• 百度核心模型进入新一轮快速迭代周期,开始接受全球用户检验 大模型圈子里,LMSYS Chatbot Arena 是一个绕不开的参考指标。它是一个国际大模型盲测平台,用户投票决定模型排名,相对客观。 文心一言5.1预览版最近悄悄上线了这个平台,…

    模型框架 2026年4月30日
  • DeepSeek 开启识图模式灰度测试,多模态视觉理解正式落地

    核心看点 • DeepSeek-V4 发布后火速上线识图模式,多模态视觉理解能力正式落地• 移动端与网页版新增识图入口,基础视觉理解、描述、推理表现出色• 极端视觉场景下识别率仍有提升空间 DeepSeek 最近有点猛。刚发完 V4 大模型,转头就把多模态识图功能灰度测试给开了。 这波操作什么意思呢?就是 DeepSeek 不仅能”看懂文字”了,还能&#…

    模型框架 2026年4月30日