小米集中发布三款玄戒自研芯片:3nm智驾方案亮相,O3系列九月登陆折叠旗舰
小米集中发布三款玄戒自研芯片:3nm智驾方案亮相,O3系列九月登陆折叠旗舰
芯东西8月24日讯,小米近期正式推出三款玄戒系列自研处理器。产品线涵盖面向移动终端的新一代AI旗舰SoC玄戒O3、面向端侧大模型的高带宽AI加速芯片玄戒O100,以及国内首款采用3nm制程的智驾高算力AI芯片玄戒D100。其中,玄戒O3计划于九月率先搭载至小米18 Fold与小米平板9 Pro Max设备中。玄戒D100与O100目前已通过回片验证,预计明年进入规模化商用阶段,发布会现场亦同步展示了基于真实芯片构建的原型机。
性能测试数据显示,玄戒O3安兔兔综合跑分突破522万分,成为首款跨越500万门槛的旗舰级SoC。该处理器同时成为全球首款支持LPDDR6内存标准的移动平台,内存带宽达到113.8GB/s。其内置的神经网络处理单元提供200TOPS张量算力,端侧人工智能推理效能较前代提升45%。
▲小米玄戒芯片负责人朱丹
玄戒芯片项目负责人朱丹指出,O3架构实现了代际跨越。面对明年秋季高通与苹果即将推出的新一代移动端SoC,团队对性能表现保持充分预期。该系列芯片的研发周期历时三年,由约三千名工程师协同完成。
一、玄戒O3:全链路AI架构重构,时延控制优于竞品
从物理规模审视,玄戒O3集成晶体管数量达240亿枚,较前代O1增长约26%。芯片核心面积维持在133平方毫米,自研标准单元库扩充至2400余个,规模达到上代产品的五倍。制程工艺全面引入沟道消除技术,晶体管密度实现5%的优化。
该处理器采用全链路AI设计思路。NPU架构经历深度重构,针对Xiaomi MiMo端侧大模型进行专项调优,提供200TOPS张量算力与3.13TFLOPS向量算力。朱丹表示,该NPU专为大语言模型推理打造,INT8精度下张量算力达到O1的2.2倍,向量算力增幅达6.8倍。
小米联合MiMo算法团队与玄戒硬件团队开展协同设计,定制开发五值量化模型。结合霍夫曼无损压缩编解码技术,模型平均位宽压缩至2.6比特,内存带宽占用降低30%。在MiMo 3B模型实测环境中,预填充阶段性能提升40%,解码阶段提升45%,整体功耗下降26%。
除NPU外,AI算力已渗透至多个计算子系统。CPU新增双SME2加速单元,提供3.5TOPS算力,端侧翻译、音视频解析及图形编码等轻量级AI任务性能提升幅度达30%至40%。
图形处理单元方面,玄戒O3新增8颗NX神经网络加速器,总算力达36TOPS。图形渲染管线内部直接集成AI超分插帧功能,规避传统架构中GPU与NPU间的双向数据搬运。540P至1080P两倍超分画质逼近原生水平,功耗降低20%。在3.2K超分与插帧并发的高负载场景下,连续运行30分钟游戏仍可维持120帧满帧输出。
GPU同时搭载16核G2-Ultra NX图形核心,支持第三代光线追踪技术。官方测试表明,光追性能提升85%,功耗削减64%。
图像信号处理器内置AINR降噪单元,显示处理单元集成硬件级AI超分模块,音频数字信号处理器亦内置专用AI引擎。
中央处理器采用十核全大核配置(6颗超大核搭配4颗大核),最高运行频率达4.35GHz。Geekbench测试中,单核得分3945,多核得分15221,多核成绩首次突破15000大关。官方数据指出,整体性能较上代提升60%,中低负载工况下功耗较O1再降25%。
存储子系统方面,片上缓存总量达60MB,涵盖12MB L2、16MB L3及新增的16MB超大容量SLC缓存。片外内存接口支持LPDDR6标准,单通道位宽由16比特拓宽至24比特,带宽提升至113.8GB/s,较O1增长48%。
功耗管理与数据流畅性方面,玄戒O3引入统一融合总线架构,采用标准化传输协议,协议转换开销较上代缩减75%。
从CPU至总线再到DDR的数据通路采用顶层金属走线设计,单此一项即可节省15纳秒传输延迟。
结合数据预取技术,玄戒O3静态时延压缩至82纳秒,动态时延降至177纳秒,较O1分别优化32%与54%。时延控制指标已超越苹果A19 Pro芯片。
二、玄戒O100:突破内存墙限制,6nm 3D堆叠架构实现1.22TB/s带宽
在详细解析O3架构后,朱丹通过附加环节引出另外两款核心产品。其中,3nm智驾芯片D100与端侧AI计算专用加速芯片O100引发行业高度关注。
玄戒O100的核心设计目标在于通过芯片级架构创新突破传统内存墙瓶颈。常规移动平台即便采用最新LPDDR6标准,数据输入输出引脚数量亦限制在96个。O100引入晶圆级垂直堆叠技术,将6nm逻辑晶圆与DRAM晶圆直接垂直集成,在异质晶圆间构建高密度垂直数据传输通道。
键合工艺方面,该芯片摒弃传统的微凸点方案(键合间距约20至50微米),转而采用Hybrid Bonding混合键合技术。该技术实现原子级精密对接,物理键合间距压缩至1.4微米,TSV硅通孔直径仅为0.7微米。
玄戒O100与顶层DRAM的互联线路多达28672根,数量约为LPDDR6标准的300倍。由此实现的峰值带宽达到每秒1.22TB,较采用LPDDR5X的旗舰机型提升16倍。
计算架构层面,逻辑晶圆部署14个AI计算核心,每个核心均与上方DRAM直连,构成完整的近存计算加速单元。系统通过小米自研的高带宽矩阵总线支持拓扑结构动态切换。预填充阶段采用环形数据流转架构,实现顺序同步;解码阶段切换至广播拓扑,将计算结果统一汇聚至指定核心。实测数据显示,玄戒O100在运行3B参数模型时,可稳定输出每秒330 token的推理速度。
朱丹指出,玄戒O100的应用场景覆盖智能手机、人形机器人及智能汽车等领域。该芯片已完成回片验证,预计明年进入商用阶段。
发布会现场未公开玄戒D100的有效算力具体数值,此为业界核心关注指标。目前以理想汽车为代表的企业自研智驾芯片算力已突破1000TOPS。
三、玄戒D100:3nm智驾平台落地,支持200B参数大模型本地化部署
小米同步公布的第三款产品为玄戒D100,该芯片定位国内首款采用3nm先进制程的智驾高算力AI处理器。
玄戒D100基于3nm工艺打造,集成20核CPU与16核NPU,最高兼容160GB统一内存架构,支持200B参数规模大模型的本地化部署。
基于D100平台,小米研发出AI Cube原型机。该设备内置玄戒O3、O100与D100三颗芯片,本地并行部署120B与3B双模型,支持快慢系统无缝切换,适用于Vibe Coding编程辅助及游戏开发等复杂场景。
朱丹确认,玄戒D100已完成全链路回片验证。沟通会现场展示区的原型机运行于真实硅片之上,非概念演示数据,预计明年正式推向市场。
结语:自研芯片矩阵步入技术转化与产品落地周期
去年五月,小米曾发布玄戒O1与T1两款自研处理器。其中,玄戒O1作为中国大陆首款采用3nm先进制程的旗舰SoC,已搭载于小米15S Pro及两款小米Pad 7系列平板设备。今年四月的小米投资者日活动上,雷军披露玄戒O1累计出货量已突破百万颗。
小米官方表示,玄戒研发团队本年度聚焦高能效、高带宽与高算力三大技术路径完成迭代升级。该系列芯片明确定位为“人车家全生态”终端的AI算力底座。
随着玄戒O3于九月随小米18 Fold正式发售,O100与D100明年进入商用阶段,小米在半导体领域的长期技术储备正逐步转化为实际产品竞争力,自研芯片业务正式迈入技术兑现与规模化落地的收获期。
查看全文
作者最近更新
-
市值突破500亿港元!北京AI视觉与存储芯片头部企业登陆港交所,一季度净利大幅攀升智东西08-26 16:49
-
小米集中发布三款玄戒自研芯片:3nm智驾方案亮相,O3系列九月登陆折叠旗舰智东西08-24 19:29
-
两年打造旗舰SoC,无锡初创企业诚恒微推出端侧AI闭环芯片智东西08-14 14:52
智东西



评论0条评论