模型框架
-
阿里发布 Qwen-Audio-3.0-ASR-Flash:专业场景语音识别新突破
阿里最近放出了新一代语音识别大模型 Qwen-Audio-3.0-ASR-Flash,主打一个「专业领域听得准」。 说实话,语音识别在平常聊天场景已经挺成熟了,但一到医疗、法律、工业这些专业领域,模型就经常掉链子——术语太密集,很多词发音还相近,误判率居高不下。这次的新模型就是冲着这个痛点去的,据说在医疗听写场景里准确率已经飙到 95% 以上。 阿里这次开了三个不同版本的接口,…
-
Kimi K3 今晚正式开源:2.8万亿参数、性能跻身全球前三
国产大模型公司月之暗面(Moonshot AI)在本月16日发布了新一代旗舰模型 Kimi K3,并宣布将于北京时间7月27日23时正式开源。目前,Kimi 已在 Hugging Face 官方账号上线 K3 模型页面,并开启权重发布倒计时。 据官方介绍,Kimi K3 是一款总参数量高达2.8万亿、上下文窗口可达100万 token 的混合专家(MoE)架构大模型。月之暗面表…
-
阿里真武M890超节点成功适配Qwen3.8,已上线百炼平台提供推理服务
阿里云公布了一项重要的技术突破:真武M890超节点成功适配Qwen3.8模型,已在百炼平台上线提供推理服务。 这标志着国产软硬件协同在大模型算力调度层面迈出了关键一步,也为超大规模AI模型的商业化部署提供了一个可行的技术方案。 真武M890是什么? 真武M890是阿里推出的自研AI超节点。简单理解,它是一台专门为大模型训练和推理设计的超级算力服务器——内部集成了高速互联的GPU…
-
上线一周调用量暴涨68倍!腾讯混元Hy3登顶全球大模型调用榜
腾讯混元官方今日发文,混元大模型Hy3总调用量较上一代Hy2增长超68倍,上线仅一周就在OpenRouter全球大模型调用量总榜排名第一。 一周登顶全球调用榜 Hy3延续了preview版本的增长态势,且展现出更高的增长斜率。关键数据: 较Hy2调用量增长:超68倍 OpenRouter全球调用量总榜:排名第一 WorkBuddy用户自选模型中Hy3占比:60% 比肩25倍参数…
-
Kimi K3即将发布:2.5万亿参数怪兽,跑分超越Opus 4.7和GPT-5.5
月之暗面(Moonshot AI)的旗舰大模型Kimi K3即将发布。根据最新内测数据,这款模型的性能已经超越了美国顶级大模型Opus 4.7,成为国产AI的又一里程碑。 发布时间临近 Kimi官方昨晚实际上已经预告了K3的发布——页面显示将从今天开始有充值优惠活动,虽然很快下架,但K3的发布也就是这一两天的事。 这个月注定是国产大模型的密集发布期。除了DeepSeek V4正…
-
xAI升级Grok Voice:新增21款多语言旗舰语音
xAI 最近对 Grok Voice 进行了一次大升级,新增了21款旗舰级语音,同时优化了原有的5款经典语音。这次更新让 Grok 的语音能力从”能用”变成了”好用”。 21款新语音覆盖多场景 新增的21款语音不是简单的”换个人说话”,而是针对不同场景做了专门优化。客户服务、角色扮演、新闻播报、教育讲解………
-
Kimi K3 确认本月发布:2.5万亿参数,国产大模型参数量新纪录
2026年下半场刚开场,大模型圈就已经热闹起来了。Kimi 的员工 Young_AGI 在 X 上确认,Kimi 新一代大模型 K3 将在本月发布,虽然没透露具体日期和技术细节,但结合之前的爆料,这波升级值得期待。 2.5万亿参数,国产最大 据此前消息,K3 的参数量将达到 2.5 万亿。这个数字什么概念? 超过 DeepSeek V4 Pro 的 1.6 万亿 超过百度文心 …
-
阿里Qwen3.7-Max正式发布:万亿参数登顶国产第一,推理成本压到GPT-5.5的1/25
核心看点 5月20日阿里云峰会,阿里发布全新一代旗舰模型Qwen3.7-Max(万亿参数MoE架构) Arena全球大模型盲测总榜中国产模型排名第一,逼近GPT、Claude、Gemini最强版本 Agentic Coding能力国产第一、全球前三,SWE-bench Verified得分72.3% 推理成本降至GPT-5.5的1/25,性价比全面领先 阿里云AI收入占外部收入…
-
马斯克放话:Grok 4.5性能比肩Claude Opus,今年每月发一个新模型
马斯克在X上宣布,xAI最新的Grok 4.5已经在SpaceX和特斯拉内部开始Beta测试,性能接近甚至超过了Anthropic的Claude Opus。 Grok 4.5什么来头? 基于1.5万亿参数的V9基础模型打造 补充训练时加入了Cursor的数据,说明xAI在重点发力编程和软件开发方向 强化学习还在持续优化中,性能还在涨 每月一个新模型 马斯克说今年剩下的时间,Sp…
-
算力提速关键突破:北大与DeepSeek联合开源大模型推理框架DSpark
大模型推理的速度和成本,一直是AI落地的两大痛点。最近,北京大学和DeepSeek联合开源了一个叫DSpark的推理框架,专门解决这两个问题。 从初步信息来看,DSpark在生成效率和吞吐量上都有显著提升。对于需要大规模部署AI服务的企业来说,这可能是个好消息。 大模型推理的痛点:慢和贵 先说说为什么大模型推理这么让人头疼。 现在的AI应用,比如ChatGPT、文心一言这些聊天…
