模型框架
-
美团万亿级大模型 LongCat-2.0-Preview 开放测试:全程国产算力,突破”卡脖子”困境
美团正在悄悄干一件大事。旗下新一代基础大模型 LongCat-2.0-Preview 已正式开放邀请测试,总参数量级突破万亿,更关键的是——全程基于国产化算力集群完成训练。 核心看点 LongCat-2.0-Preview 采用混合专家(MoE)架构,总参数量级达万亿级别 整体能力对标 GPT-4,跻身全球顶尖大模型行列 全程基于国产化算力集群训练,标志着美团在国产算力训练万亿…
-
蚂蚁百灵发布万亿旗舰 Ling-2.6-1T:不走推理路线的”快思考”模型,对标 GPT-5.4
蚂蚁集团旗下百灵大模型团队正式发布了一款不走寻常路的作品——面向即时任务执行的万亿级综合旗舰模型 Ling-2.6-1T。它放弃了行业普遍追求的”慢思考”多步推理模式,用”快思考”机制硬刚 GPT-5.4 非推理版。 核心看点 Ling-2.6-1T 采用 MLA + LinearAttention 混合架构,万亿参数仅凭极低 T…
-
国家超算互联网上线 DeepSeek-V4 免费对话:百万上下文从「高端选配」变「基础标配」
4 月 26 日,国家超算互联网宣布推出 DeepSeek-V4 限时免费对话服务。企业、科研机构及个人开发者登录超算互联网(www.scnet.cn)即可免费体验百万 Token 超长上下文实时对话。 核心看点 国家超算互联网免费提供 DeepSeek-V4 百万上下文对话服务 百万上下文相当于《三体》三部曲总字数,可一次性处理全文并全局思考 此前百万上下文能力仅出现在闭源高…
-
DeepSeek-V4预览版正式发布:1M超长上下文进入全员普惠时代
4月24日,DeepSeek正式发布了V4预览版,这款开源大模型带来了两个重磅升级:1M超长上下文能力,以及结构创新和Agent生态适配。这意味着,处理超长文档、视频分析、复杂代码库等场景,不再需要昂贵的闭源API。 核心看点 1M上下文普惠化:DeepSeek-V4将百万级上下文窗口带入开源领域,Pro版性能接近顶级闭源模型,Flash版则主打性价比,满足不同场景需求。 DS…
-
OpenAI发布GPT-5.5:运算更快Token更省,科研能力大幅提升
核心看点 OpenAI发布GPT-5.5,号称”最智能、最直观”的版本 运算速度更快,Token消耗显著降低 电脑操控和科研能力大幅提升,可应用于药物研发 OpenAI又放大招了。4月24日,GPT-5.5正式发布,官方给出的定义很直接:这是迄今为止智能程度最高、使用体验最直观的版本。联合创始人布罗克曼透露,相比5.4版本,5.5在运算速度、逻辑精准度上…
-
DeepSeek-V4预览版发布:1M超长上下文进入普惠时代
核心看点 DeepSeek-V4预览版正式发布,开源并支持1M超长上下文 提供Pro和Flash双版本,兼顾性能与性价比 寒武纪完成Day 0适配,国产芯片生态加速完善 4月24日,深度求索(DeepSeek)正式发布了V4预览版,这次更新可以说是国产大模型领域的又一里程碑。最让人眼前一亮的是,V4直接标配了1M超长上下文能力,这意味着什么?简单来说,你可以扔给AI一整本书、一…
-
DeepSeek-V4正式发布:国产大模型迎来百万上下文时代
4月24日,深度求索(DeepSeek)正式发布V4模型预览版,这是国产开源大模型领域的又一里程碑。此次发布的V4系列包含两个版本:285B参数的DeepSeek-V4-flash和1.6T参数的DeepSeek-V4-pro,均已在发布当日实现稳定运行。 核心看点 百万级超长上下文:V4支持1M超长上下文记忆,在处理长文档、代码库分析等场景下表现突出 双版本策略:flash版…
-
OpenAI发布GPT-5.5:运算速度飙升,Token成本大幅下降
4月24日,OpenAI正式发布新一代大语言模型GPT-5.5。公司称其为”迄今为止智能程度最高、使用体验最为直观的版本”。 核心看点 相比GPT-5.4,运算速度更快、逻辑更精准,且Token消耗显著减少 适用场景广泛:从智能体编程、知识处理等企业级应用,到数学运算、科学研究等前沿领域 在操控电脑完成办公任务方面能力优于前代,科研和技术研究流程实现明显…
-
寒武纪Day 0适配DeepSeek-V4:国产AI芯片的又一次突破
4月24日,寒武纪宣布已完成对DeepSeek-V4的Day 0适配——模型发布当日即可稳定运行,适配代码已开源至GitHub。 核心看点 基于vLLM推理框架,完成285B DeepSeek-V4-flash和1.6T DeepSeek-V4-pro的即时适配 通过自研融合算子库Torch-MLU-Ops,对Compressor、mHC等新结构进行专项加速 利用BangC高性…
-
Kimi K2.6正式发布:编程能力突破,推理效率比行业主流高20%
月之暗面今日正式发布Kimi K2.6模型,在编程能力、长程任务处理及多Agent协作方面实现重大突破。据官方透露,该模型在多项权威测试中已进入行业第一梯队,性能可与国际顶尖闭源模型正面竞争。 核心看点 编程能力飞跃:K2.6在代码生成、理解和调试方面实现质的提升,成为开发者群体的强力助手 长程任务处理:支持超长上下文记忆,能够处理复杂的持续对话和多步骤任务 多Agent协作:…
