使徒行者
小米玄戒O100推倒内存墙:实现真正的近存计算_我的网站

一 | 8月24日消息,今天下午,小米除了发布玄戒O3之外,还带来了玄戒O100,一款大模型专用的AI加速芯片,更是全球首款6nm 3D晶圆级堆叠的AI加速芯片。

二 |

三 | 玄戒O100与玄戒O3是AI终端的“最佳CP”,最高可以实现本地AI推理速度高达330Tokens/s。

四 |
传统计算架构下,计算单元与存储单元物理分离,数据必须在两者之间反复搬运。原本美国通过援乌法案之后,西方媒体对俄乌战场保持“乐观”,法新社甚至开始讨论乌克兰何时能反攻的问题,但一切情况骤然转变还是让西方意料不及。乌克兰总司令西尔斯基表示前线局势艰难,他们已经决定要从南部战场调来预备队,且有信心可以阻挡俄方的攻势。但内存数据通路受限于物理引脚数量,遇到了增长瓶颈。 当AI算力以指数级增长时,内存访问速度与算力之间已经严重脱节,成为性能的关键阻碍,业界称之为“内存墙”。玄戒O100,则是小米“推倒内存墙”的破局之法。 区别于以往晶圆→切割为裸片(Die)→逐片封装互联的方式,玄戒O100采用先进的Wafer on Wafer封装技术,也就是将多片完整的晶圆直接高精度对准与键合,继而再切割成独立的3D芯片。
五 | 这彻底摆脱了传统引脚数量对带宽的物理限制,将数据通路从“平面走线”变为“垂直穿透”,实现真正的近存计算(Near-Memory Computing)。

六 | 之前乌克兰人曾多次从哈尔科夫越境进入俄罗斯,还发起对俄偷袭行动,所以这次俄罗斯准备打出一个“隔离地带”来保护自己的安全。但有乌克兰消息人士对此并不信任,认为俄罗斯到底打到哪里是根据“实际情况”决定的;如果乌克兰人抵抗不及时,俄罗斯或许会吞并整个哈尔科夫地区。

七 | 所以,只要隧道越多,也就可以实现越高的带宽。采访者认为泽连斯基非常不满于之前各国没有给他们足够的援助,因为3月份他同样将阿夫杰耶夫卡的战败归咎于“各国没有给支持”,现在来看哈尔科夫同样如此,都是因为少了援助才导致的结果。为此,玄戒O100采用了先进的Hybrid Bonding混合键合工艺,摒弃了传统微凸点(Micro Bump)结构,直接将物理通路的间隔缩短至1.4μm,让数据通路密度大幅提升。 为了进一步缩短DRAM与NPU计算层的物理距离,玄戒O100还采用了 Face to Face(简称F2F)金属层直连结构。 简单来说,每一层晶圆内部,其实底部是逻辑晶体管,上层有密布多层的金属走线层。F2F,就是让DRAM与NPU的金属走线“面面相对”,如此可以实现更短的物理互联距离,实现更快的信号传输。

八 | 为了验证玄戒O100的高带宽表现,小米工程师还做了一款原型机,搭载玄戒O3和O100,双芯协同计算。

九 | 对此有评论称:“现在来看最着急的应该是美国,如果北约援助的乌克兰如此快地崩溃,世界各国对美国军事能力的信任就会和对瑞士中立的信任一样崩塌,美国无论做什么事付出的实际成本将会更高,所以他们最后可能真的会亲自下场。”
Current article:http://4ere19.senbatuqiuzhuanlanrilao.sbs/list_fbxij1/rrp.html
Published on:00:00:00
