差友们乡亲们,时隔一年多,小米又发新的芯片了!

直到我到了沟通会现场,才知道原来小米在芯片的野心,已经不止于用在手机了:
AI、车机、智驾,它是都想要啊。。。
不过首先还得聊聊先上场的玄戒 O3 移动端芯片。
去年直奔旗舰性能的玄戒 O1,给大伙留下了深刻的印象。而这次的 O3,托尼认为是在 O1 的基础上,继续对标第一梯队的性能。
因为 O3 跑出了 500 多万的安兔兔跑分。。。先不说别的,至少跑分这块是直接把苹果、高通和发哥目前已发布的旗舰芯片踩在脚下了。
至于能不能和今年 8E6、 9600 等新旗舰们掰掰手腕,还得等友商出手。
不过小米自己也说了,500 多万的跑分是在实验室环境下测得的,还算诚实嗷。

最明显的变化是在架构方面。可能是觉得四丛集太难调度,玄戒 O3 这次选择相对成熟的三丛集十核 CPU 设计。
而且和友商们一样,放弃了小核,转而使用了全大核设计 —— 2 个 C1-Ultra、4 个 C1-Premium、4 个 C1-Pro。

对比同样使用 3nm 和 C1 架构的 天玑 9500,玄戒 O3 不仅多了一个 Ultra 核心 + 一个 Premium 核心,而且频率进一步提了 0.14 GHz。
核心更多,频率更高,性能自然强了不少。根据小米的说法,GeekBench 6 单核 3945 分,已经能和 A19 Pro、 骁龙 8E Gen5 平起平坐;而多核 15221 更是拿下了目前手机 CPU 第一的宝座。

这点小米也有专门提到,这次玄戒 O3 通过改进的动态调频调压、并且应用了直穿式顶层走线和沟道消除工艺,玄戒 O3 在中低负载下的能耗对比玄戒 O1 可以降低 25%。。。


根据小米提供的资料,除了架构的提升,玄戒 O3 还吸取了 O1 的经验,继续加码缓存。
不光 CPU 加了块 16MB 的 L3 缓存,同时系统又加了一块 16MB 的 SLC 缓存。
更大的缓存,意味着更快的数据读取速度和更低的功耗。玄戒 O3 在制程不变的情况下还能进一步提升能效,缓存的加入肯定算一个原因。
当然了,SoC 的其他部分,小米堆料也很足:像是可以提供 200TOPS 张量算力(A8W4)的 NPU、支持 H.266 的硬件解码器,以及 RISC-V 安全核心,最新的 LPDDR6 内存规格支持等等。。。


也就是说,尽管工艺不变,但晶体管密度却有小幅提高。
托尼专门问了小米的工程师,他们的答案是:一方面小米在 O1 的基础上,自主设计了更多的 StdCell 单元,有了更多的通用件,就可以进一步减少芯片面积。
另一方面,小米这次用上行业内比较常见的沟道消除技术,可以进一步减少走线面积。在芯片设计中,这种 " 不留沟道直接穿越 " 的原理其实都能想到,但想完整贯彻这套逻辑,确实需要一定芯片设计能力。

而且小米这次看起来信心也很足:直接把玄戒 O3 的首发机型定给了小米 18 Fold,9 月正式上市,托尼届时也会看看玄戒 O3 的实机表现到底如何。

玄戒 O100 和 D100。
先说更有意思的 O100。简单来说,O100 是专门用来 AI 加速的芯片,它给了完全不一样的端侧大模型的运行方案。
虽然它是一颗 6nm 芯片,但是这张 PPT 里的关键词是 "3D 晶圆级堆叠 "。

芯片算力影响大模型需要多久吐出第一个字,内存速度影响了这个字吐出来的速度能有多快。而在手机上,芯片算力倒是提升不少,但内存速度就没怎么跟上。。。
就拿 LPDDR5X 来说吧,目前在用的 LPDDR5X 带宽最快大约 85GB/s,而下一代 LPDDR6,大约在 114 GB/s。
看上去有 30% 的提升,但对于 LLM 来说,这点带宽还是太少了。。。
这就导致想要在端侧部署大模型,总会卡在内存速度上。而玄戒 O100 就是要解决内存这个问题的。
那么它具体有多快呢?答案是 1.22TB/s!





这点哪儿够跑大模型。。。
而有了晶圆堆叠和混合键合这两个技术,内存不仅能够更近地贴合在 SoC 上,而且可以做到更多的引脚数量,以及更短的物理通路。

根据小米的说法,传统 PoP 堆叠封装的直连通路是 96 路。
而玄戒 O100 这次采用混合键合之后的直连通路是 28672 路,提升了将近 300 倍。。。
最后压轴登场的,是块大家伙 —— 玄戒 D100。



话说这玩意能不能开售啊!
不过 PPT 里也有一个小点需要注意一下:小米只说了这玩意能运行 120B 和 3B 两种模型,但是具体是什么模型、跑在什么量化参数下,我们都不知道。
所以这玩意的极限是只能跑个 120B 的模型,还是我们能想想办法把梁叔叔的模型用 Q4 甚至 1bit 的方式塞进来,短时间可能都不得而知了。

因为在 O1 之后,玄戒似乎就消失在了人们的视线中。甚至总有消息爆出小米要放弃玄戒芯片。
但现在,小米在一片质疑声中,一口气拿出三款芯片。而且每款芯片都有属于自己的特色。
去年我说,就冲小米造芯片的这份勇气,我是服的。
今年感觉小米的勇气和信心似乎更足了。
因为这三款芯片一出手,不仅能解决手机的问题,还能解决车载芯片的问题。

小米的答案是:要上就上,而且直接上全家桶。这就很有意思了。
而且汽车这边本来就有自研芯片的风,不论是蔚小理,还是华为等厂商都有自己的智驾芯片。
原因无他,更加方便自己训练、部署并调优智驾算法。
这么想的话,小米未来搭载玄戒全家桶的汽车,车机、轻度负载用 O3,小模型推理用 O100,智驾等大模型用 D100,每块芯片都有自己的用处,想象空间蛮大的。
所以玄戒真正的价值其实在于,减少对高通的依赖,增强自己的软硬件整合能力。
况且玄戒这波节奏还不算慢。玄戒 O3 九月份就会有机器发布,而 O100 和 D100 将在明年正式商用。

撰文:洛洛
编辑:米罗 & 面线
美编:素描
图片、资料来源:
小米手机微博
三星技术官网
AI 生成

