模型
-
京东开源全球首个全栈视觉交互模型,AI终于能”边看边说”了
京东最近搞了个大动作——正式开源了JoyAI-VL-Interaction实时视频视觉语言交互模型。这玩意儿号称全球首个全栈开源的视觉交互模型,连整套部署系统都一并放出来了。 传统AI的痛点:太被动了 现在市面上的多模态模型基本都是”你问我答”的模式,用户不提问,AI就傻站着。这种被动式交互在实时监控、直播讲解这些场景里根本不够用。 JoyAI的三大革新…
-
阿里发布Qwen-Robot系列具身大模型:三大模型协同攻克异构机器人适配痛点
具身智能赛道又有大动作——阿里巴巴正式发布 Qwen-Robot 系列具身大模型,一口气推出三大核心模型,瞄准的是机器人行业最头疼的问题:异构机器人适配。 行业痛点 为什么具身智能这么难?核心原因之一就是「硬件异构」——不同公司的机器人硬件完全不同,机械臂的结构、传感器的配置、运动控制的接口都不一样。 传统做法是「一个机器人一套模型」,但这样成本极高、扩展性极差。一个通用机器人…
-
谷歌发布 DiffusionGemma:本地 AI 推理速度飙升 4 倍,文本扩散模型来了
【核心看点】 谷歌在 6 月 11 日放出了一个新玩意——DiffusionGemma。这是一款实验性的开源文本扩散模型,最大的卖点是本地推理速度比传统自回归模型提升了整整 4 倍。如果这一方向被验证可行,它可能彻底改变大模型在端侧设备上的运行方式。 【详细解析】 文本扩散是什么? 我们熟悉的大语言模型(如 GPT、Gemini)大多是自回归模型,也就是从左到右、逐词生成的方式…
-
Google重磅开源DiffusionGemma:文本生成速度提升4倍,打破自回归模型垄断
谷歌又来搞事情了!这次不是Gemini的更新,而是一款全新的开源模型——DiffusionGemma。 核心看点 6月11日,谷歌正式发布并开源了DiffusionGemma,这是一款基于文本扩散机制的大语言模型。与传统的GPT、Gemini等自回归模型不同,DiffusionGemma采用了一种全新的文本生成方式,在本地推理速度上实现了4倍的提升。 什么是文本扩散模型? 传统…
-
Anthropic发布史上最强Claude Fable 5:Mythos级模型首次向公众开放
核心看点 6月9日,Anthropic正式发布Claude Fable 5,这是该公司迄今为止向公开市场推出的最强模型 首个公开可用的Mythos级AI模型,此前Mythos分类仅用于内部前沿模型 跑分屠榜:SWE-Bench Pro 80.3%,FrontierCode Diamond 29.3%,全面领先GPT 5.5和Gemini 3.1 双模型策略:Fable 5面向公…
-
中国AI大模型周调用量创新高,包揽全球前四
中国AI大模型正在加速超车。 6月8日消息,中国AI大模型上周的周调用量达到14.19万亿Token,环比增长27.49%,连续六周超越美国。国产大模型霸榜前四,DeepSeek-V4-Flash、腾讯Hy3 preview和MiniMaxM3表现突出。 核心看点 调用量新高:中国AI大模型周调用量达14.19万亿Token,环比增长27.49% 连续六周领先:连续六周超越美国…
-
MiniMax M3与英伟达Cosmos3同日发布,国产大模型与物理AI双突破
核心看点 6月1日,AI模型领域迎来两个重磅发布:MiniMax推出自研M3大模型,首创MSA稀疏注意力架构;英伟达发布全球首款全开源全模态物理AI大模型Cosmos3,并联合行业巨头成立”宇宙联盟”。国产大模型与物理AI同日突破,颇有看点。 详细解析 1. MiniMax M3:MSA架构+1M上下文,性能超越GPT-5.5 M3采用自主研发的稀疏注意…
-
LobsterAI接入四大图像视频模型:一个平台搞定Seedream、Seedance、HappyHorse、MiniMax-Hailuo
核心看点: 一次性接入Seedream、Seedance、HappyHorse、MiniMax-Hailuo四大主流模型 多模型矩阵联动,降低开发者和创作者调用多模态AI的门槛 覆盖图片生成和视频生成两大领域 做内容创作的人有个痛点:不同AI画图和视频工具各有优劣,换来换去很麻烦。LobsterAI的新动作就是解决这个问题——把四大主流图像视频生成模型整合到一个平台里。 四大模…
-
MiniMax M3发布:国产首个百万上下文开源大模型,编程能力超GPT-5.5
核心看点: 国内首个同时具备”前沿编程+百万上下文+原生多模态”三项能力的开源模型 自研MSA稀疏注意力架构,1M上下文下每token计算量仅为上代1/20 编程评测超越GPT-5.5和Gemini 3.1 Pro,代码可直接交付不用改 6月1日,MiniMax稀宇科技正式发布通用大模型M3。这不是一次普通的模型升级,而是国产大模型在三个关键维度上同时实…
-
Claude Opus 4.8 刚上线就被曝”蒸馏”中国模型:自称是千问和DeepSeek,Anthropic陷”双标”争议
核心看点 1. Claude Opus 4.8 被曝”身份错乱” 5月29日,AI圈爆出重磅消息——Anthropic 最新发布的旗舰模型 Claude Opus 4.8 在 API 测试中被用户发现:当询问”你是谁”时,模型有时会自称是阿里的 通义千问(Qwen) 或者 DeepSeek。 这相当于你去吃麦当劳,服务员说R…
