模型框架
-
阿里开源Qwen3.8-Flash:提前体验下一代Qwen4架构,性价比碾压同级
阿里千问团队又放大招了!这次开源的Qwen3.8-Flash虽然名字还在3.X系列,但骨子里已经是下一代Qwen4架构的技术预览版。 简单说,就是让你提前用上了未来的技术。 核心参数一览 这是一个多模态MoE模型,总参数量125B,但每个token只激活6B,属于典型的”大力出奇迹、用小力干活”的设计。原生支持262K上下文,通过YaRN技术可以扩展到1…
-
小米玄戒O100正式发布:专为端侧大模型设计的AI加速芯片,带宽提升16倍
在小米%ignore_a_1%技术沟通会上,除了三芯协同的AI Cube工程版,小米还正式发布了首款自研AI加速芯片玄戒O100。这颗芯片的核心使命只有一个:让端侧大模型跑得更爽。 为什么需要专门的AI加速芯片? 现在的手机SoC跑生成式AI任务时,普遍存在一个痛点——数据搬运效率太低。CPU/GPU和内存之间的数据传输路径太长,导致大模型生成时容易卡顿,推理速度也上不去。玄戒…
-
小米玄戒O100详解:6nm 3D堆叠封装,1.22TB/s带宽突破端侧AI瓶颈
小米玄戒O100可能是近期最值得关注的国产AI芯片之一。这颗芯片的定位非常明确——专为端侧大模型设计的高带宽AI加速芯片,解决的是当前手机SoC跑AI时普遍存在的内存墙问题。 3D堆叠封装是核心亮点 玄戒O100采用了行业首颗6nm晶圆级垂直堆叠(Wafer on Wafer)封装工艺,搭配Hybrid Bonding混合键合技术,实现了1.4微米的超小键合间距。这种Face-…
-
小米AI Cube工程版亮相:三芯协同架构,本地可跑120B大模型
小米在玄戒技术沟通会上亮出了一款让人眼前一亮的工程原型——AI Cube Prototype迷你主机。这台小机器最狠的地方在于:它能在本地跑1200亿参数的大模型,而且不需要联网。 实现这个能力靠的是一套三芯协同的异构架构: 玄戒O3:AI旗舰SoC,10核全大核CPU + 16核GPU + 200 TOPS NPU 玄戒O100:AI加速芯片,6nm 3D晶圆级堆叠封装,提供…
-
玄戒三芯合体!小米AI Cube工程版亮相:150W功耗 可本地跑大模型
快科技8月24日消息,在今日举办的小米玄戒技术沟通会上,小米AI Cube Prototype工程版迷你主机正式亮相。 该主机采用三芯协同架构,由玄戒O3、玄戒O100及玄戒D100三颗自研芯片组成,持续性能释放高达150W,实现了超大规模大模型在端侧的本地部署。 作为核心算力来源,玄戒O3定位AI旗舰SoC,采用了10核全大核CPU架构及16核G2-Ultra NX GPU,…
-
AI日报:万相Wan3.0模型上线;小米发布玄戒O3等AI芯片;第二届世界人形机器人运动会开幕
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。 1、万相Wan3.0视频生成模型正式上线,解锁30秒长视频创作新体验 万相Wan3.0视频生成模型正式上线,带来30秒长视频创作的新体验,支持多种文档格式输入,并在多个领域展现出卓越的性能。 【AiBase提要:】 🎥 单次最高…
-
小米玄戒O100实测:端侧AI性能提升10倍,330Tokens/s流畅跑大模型
在%ignore_a_1%技术沟通会上,小米正式亮相了首款自研AI加速芯片玄戒O100。这款芯片的定位非常明确——专为端侧大模型而生的协处理器,目标是从底层解决端侧AI的带宽瓶颈问题。 传统SoC的痛点:数据搬运效率低 传统手机SoC在运行生成式AI任务时,普遍存在一个关键问题:数据搬运效率偏低。内存和计算单元之间的数据传输路径长、带宽有限,导致大模型生成卡顿、推理速度受限。这…
-
小米玄戒O100详解:行业首颗6nm 3D堆叠AI芯片,带宽1.22TB/s
小米玄戒O100是这次技术沟通会上最受关注的产品之一。作为小米首颗专为端侧大模型设计的AI加速芯片,它用一项行业首创的技术解决了端侧AI的内存墙难题。 6nm 3D晶圆级堆叠:行业首创 玄戒O100采用了Wafer on Wafer(WoW)晶圆级垂直堆叠封装工艺,这是行业首款采用该技术的AI芯片。通过Hybrid Bonding混合键合技术,实现了1.4微米的超小键合间距。 …
-
小米AI Cube工程版亮相:三芯协同150W功耗,可本地跑1200亿参数大模型
小米在玄戒技术沟通会上展示了一款让人眼前一亮的工程原型——小米AI Cube Prototype迷你主机。这款设备的核心卖点在于三芯协同,实现了超大规模大模型的端侧本地部署。 三颗自研芯片各司其职 AI Cube采用了玄戒O3、玄戒O100和玄戒D100三颗小米自研芯片的异构协同架构: 玄戒O3:作为核心算力来源,采用10核全大核CPU架构及16核G2-Ultra NX GPU…
-
匿名模型Ox Alpha登顶OpenRouter:4万亿Token调用量,开发者疯狂追捧
一个名为Ox Alpha的匿名AI模型最近在开发者圈子引起了轰动。这个模型的开发商没有公开身份,但它却在OpenRouter平台迅速登顶,累计调用量超过4万亿Token,刷新了单日调用量纪录。更神秘的是,尽管社区对其技术背景有多种猜测,但没有任何厂商正式认领这个模型。 OpenRouter:AI模型的”交易所” 要理解Ox Alpha的火爆,首先需要了解…
