关于ZAKER Skills 合作
新浪财经 11分钟前

方兴东:任正非 2025 年整个春节都在部署指挥华为相关产品应对 DeepSeek 带来的流量海啸

来源:睿见 Economy

昇腾崛起:潮水深处的奋力突围

文:方兴东 浙江大学传媒与国际文化学院常务副院长、《昇腾崛起》作者

回溯至一年前的 2025 年春节,华为人都知道 DeepSeek 曾带给任正非何等异乎寻常的振奋。整个春节,他都在部署指挥华为云和相关产品,应对 DeepSeek 带来的流量海啸。他的兴奋显然不止于产品和流量,而是源于对格局高度的洞察。可以说,作为在高科技领域征战 40 余年的中国企业家,他第一次真切感受到,中国企业有望真正实现 " 软硬协同 "。对比以往在全球市场中长期 " 孤军奋战 " 的局面,中国企业能在根技术和生态层面形成合力,这是历史上的第一次。

当然,彼时站在全球聚光灯下的梁文锋,并未对外释放更多明确信息。尽管昇腾已在 DeepSeek 的推理应用中大显身手,但双方在大模型训练层面的深度协同,仍需要一个水到渠成的过程。

当然,这种 " 遇冷 " 只是时间问题,时代的大潮和历史的洪流,终将把任正非和梁文锋两位还不同频的企业家,推向改写全球 AI 格局的同一个轨道。DeepSeek V4 技术报告封面上印了两行字:英伟达 GPU,华为昇腾 NPU ①。任正非期盼已久的局面—— DeepSeek 全面启动基于华为昇腾的训练,已然真正拉开序幕。这,才是真正意义上的历史性转折点!

DeepSeek 牵动全球 A2 格局,历史性转折点正式到来

2026 年 3 月 10 日,我在坂田华为基地 K 区和徐直军再次喝咖啡,这一次的任务是要为即将出版的图书定下名字。" 就叫《昇腾崛起》吧!" 经过多次的选择,徐直军轻轻地定了调。崛起,就是崛起这两个字,可以概括昇腾过去 "8 年抗战 " 的惊心动魄,也才能概括昇腾对于华为,对于中国乃至高科技逐渐释放的影响与意义。

历史风云,往往隐于新闻的喧嚣之外,藏在轻描淡写的只言片语之中。而本书,就是为大家揭开这一历史进程的最真实的故事。6 年,对近百人进行了深度访谈,受访者几乎涵盖了所有关键的亲历者,本书为大家素描出这段历程中的人和事。

书写昇腾,就是要讲好华为创新的故事

2025 年 9 月 19 日上午 9 时 10 分,我走进上海世博滨江大酒店,穿过人声鼎沸的大堂,在一楼餐厅的小包房坐下来,等待华为副董事长、轮值董事长徐直军的到来。窗外,黄浦江的水面在秋日的晨光里泛着光。这一次见面,主要是为《昇腾崛起》这本书定调。

前一天的 9 月 18 日,华为全联接大会 2025 在上海开幕。徐直军激情澎湃地发表题为 " 以开创的超节点互联技术,引领 AI 基础设施新范式 " 的演讲,正式发布全球最强算力超节点和集群。这是华为 5 年多来第一次打破沉默,公开谈论昇腾芯片——这个讳莫如深的名字,终于重新出现在聚光灯下。也许做 " 地下工作 " 憋得太久,这一次除了发布昇腾 950 芯片,他还一股脑发布了未来两年的昇腾 960 和昇腾 970。一梭子重磅发布,不只是华为底气和信心的展示,更重要的是传达了一个清晰的信号:华为 AI 芯片重新回到了正常的迭代节奏——一年一个版本的迭代速度。因为美国政府的制裁,在全球 AI 最高歌猛进、热血鼎沸的 5 年中,华为昇腾的节奏被全面压制,失去了唯一对等竞争对手的英伟达,也由此走上了一马平川的 " 造神之路 "。5 年,对一个身处 AI 时代浪潮中心的芯片来说,是一段足以改变格局的时间。

昇腾,终于回来了!

徐直军说:" 算力过去是、未来也将继续是 AI 的关键,更是中国 AI 的关键。" 并再次强调:" 基于中国可获得的芯片制造工艺,华为努力打造‘超节点 + 集群’算力解决方案,以满足持续增长的算力需求。"" 华为将以基于灵衢的超节点和集群持续满足算力快速增长的需求,推动 AI 持续发展,创造更大的价值。"5 年时间,华为 AI 芯片第一次公开亮相,而且一亮相就是如此高调,有点超乎想象——这背后究竟发生了什么?若想揭开这个秘密,我们必须得回到 6 年前。

2019 年入冬,深圳福田区喜来登酒店,我和徐直军坐在大堂的咖啡厅,谋划一件越聊越兴奋的事:围绕华为的 6 款产品展开深度访谈,全景式记录这些产品的突破之路。每款产品深度访谈约 50 位关键人物,围绕每款产品写一本书。6 款产品分别是 3 款软件——服务器操作系统欧拉、终端操作系统鸿蒙和数据库高斯,以及 3 款芯片——服务器芯片鲲鹏、AI 芯片昇腾和终端芯片麒麟。" 现在把拳头收回来,补课。用 5 年时间,争取 2024 年 6 本书都出来。"

而事实上,从 2023 年第一本《欧拉崛起》,到 2025 年 5 月的《鸿蒙开物》,才出版了两本。此时,单框架鸿蒙正式出击。也就是说,真正的鸿蒙生态刚刚拉开帷幕。2026 年,《昇腾崛起》终于可以亮相。这才是第三本。虽然《鲲鹏展翅》也呼之欲出,但是,目前看来,要把 6 本书出齐,基本要到 2027 年。比原计划晚了整整 3 年。

所以,我跟徐直军说:" 你看,我们当初预计 5 年时间结束战斗,看来还是乐观了点。" 徐直军说:" 当然不可能那么准确。但是,今天 6 款产品发展的整体态势,都在预测之中。" 的确,当初觉得 5 年时间很漫长,而事实上,六七年时间霍霍然,仿佛一晃之间。今天的华为,已经与制裁之初的那种茫然、人人自危的局面完全不同,呈现出全新的面貌。这 6 款产品,无疑是这种底气和自信的来源。

6 款产品可以说各有各的精彩,各有各的曲折,也各有各的特性。酸甜苦辣,不尽相同。尤其是昇腾,与欧拉、鸿蒙、麒麟、鲲鹏、高斯不同——那几款产品的首要使命,是临危 " 自救 ",是着眼于解决 " 卡脖子 ",是无路可走的紧急补课。昇腾则是另一种境况。如果说鸿蒙的开发故事是一部悲壮史,昇腾则不然——尽管昇腾的悲壮和曲折可能一点儿也不比鸿蒙少。与绝境中力挽狂澜的鸿蒙不同,昇腾是逆境中崛起的一个 " 意外 "。昇腾的开发过程是一个创新的故事,首先是一部创新史。书写昇腾,就是要讲好这个创新的故事,真正展示华为是如何创新的。

前言

昇腾,DeepSeek 浪潮下的中国 AI 新底座

DeepSeek 的引爆与昇腾之间究竟是什么关系?这可能远比我们想象的要深入得多。

2025 年初,寒风凛冽的冬日,一列动车飞驰在铁轨上。车厢里灯光柔和,旅客倦意未消。在人群中,一名华为云的技术人员却没有时间休息。他穿过早已被归乡和返程的旅客占满的座位区,倚靠在动车的洗手台边,寻找着车厢内为数不多的电源插座,手机电量在高强度的会议消耗下,几近枯竭。他低头插上充电线,手机屏幕上跳动着不断更新的工作群消息,耳机里传来会议发言人员紧凑而洪亮的声音,各路技术专家正通宵达旦地协同攻关。动车的运行噪声、广播的播报声、旅客的交谈声混杂在一起,但这些都无法干扰他的专注。他指尖飞舞,记录着会议上最主要的工作部署,时不时切换到远程控制界面,监测数据流量的变化。他发言的语速很快,生怕列车行驶到信号盲区时会错过关键指令。

会议开完后,华为和硅基流动团队全员上阵。这时,华为员工有的在机场,有的已经回家乡,还有的已经和家人在国外休假,他们甚至来不及与亲人团聚,便一起投入这场 " 技术救援 "。

2025 年 1 月 28 日,当天上午 9 点的会议,华为高层便下达了华为云快速支持 DeepSeek 的决策:一是昇腾与 DeepSeek 此前已积累合作联创的基础,具备快速对接的前提;二是能够迅速调动现有的高性能昇腾卡,帮助其承接快速爆发的流量;同时,对华为云提出要求,利用全球云节点、全球存算网,以及云上安全防护能力,为 DeepSeek App 在全球范围内的稳定运行提供全方位技术支持。

华为云团队敏锐地洞察到,DeepSeek 正在改写全球 AI 的竞争格局。即使 DeepSeek 暂未立即使用昇腾,也可以在云上把它接进来。为此,海思、华为云等多个团队,共集结 230 多名技术骨干,分成总体架构、资源供给、昇腾算子、模型调优、业务运维这 5 个会战攻关组。华为云贵安数据中心紧急开通了 1 024 张昇腾 910B 芯片,机房内各节点闪烁着红蓝交织的指示灯,仿佛即将迎接凤凰涅槃的仪式。华为技术团队协助硅基流动团队跑通 DeepSeek-V3 模型端到端推理流程,并且完成了 DeepSeek-V3 大模型的性能与精度初步验证。

外面,城市已经陷入深夜的沉寂,而在华为的办公大楼里,这场商业级别的极速部署仍在持续。从除夕夜到大年初二,双方团队日夜奋战,完成了 3 000 多张昇腾芯片的部署和验证,最终将 DeepSeek-V3/R1 大模型成功部署到华为云贵安数据中心昇腾云上,点亮了国产领先 AI 算力 +AI 大模型的灯塔,照亮了国产算力支持国产大模型之路。

这不只是一场普通的会议,这是一场席卷全球的技术风暴—— DeepSeek AI 平台的一次史无前例的挑战。2025 年春节期间,DeepSeek 的用户数量如潮水般暴增,全球成千上万的用户蜂拥而至,猛烈冲击着每一条数据管道,打破了 " 美国 AI 不可超越 " 的神话。正如华为 Fellow、2012 实验室及海思首席科学家廖恒所说:"DeepSeek 是一个非常美妙的奇迹。"

伟大不能被规划,奇迹都在意料之外。DeepSeek 冲击波,不仅在梁文锋和 DeepSeek 的意料之外,也在整个中国和整个世界的意料之外。虽然梁文锋对于抵达通用人工智能(AGI)有着坚定的信念,对于自己和团队的工作也有着充足的信心,但是对于 2025 年春节这场巨大的冲击波,他是始料未及的。国内不少模型团队甚至陷入了 " 为什么我们做不出来 " 的自我怀疑,但这种怀疑很快转化为动力。仅仅 1~2 个季度后,DeepSeek 的训练方法和模型结构便成为诸多国产大模型竞相学习的榜样,一场由 DeepSeek 引发的技术追赶赛让中国 AI 行业整体加速前行。

春节过后,DeepSeek 的热度依然不减,用户量持续攀升。华为云的工程师们继续为这款应用提供支持,他们帮助 DeepSeek 进行数据库扩容和负载均衡,确保应用能够稳定运行。同时,他们也在思考如何进一步提升 DeepSeek 的推理能力。华为云的工程师们并没有因此停下脚步。他们在为 DeepSeek 保驾护航的同时,更着眼于昇腾云的未来布局,计划推出更高效率的超节点集群,性能可与英伟达 NVL72 相媲美。他们相信,昇腾云将成为中国 AI 领域的一颗璀璨明珠。

昇腾与 DeepSeek 联动的力量,构建生态思维

2024 年夏日的上海,街头依旧笼罩着闷热的空气。上海东亚银行金融大厦的会议室内,一场极具分量的会面即将展开。大厦内,一间低调的会议室里,空气中弥漫着一丝紧张又兴奋的气息。来自华为海思部门的技术骨干和相关人员已悉数到场,他们或低声交谈,或翻阅着手中的资料,眼神中透露着对这次交流的期待。他们此行的目的,是与一个在技术圈子里早已声名鹊起,却鲜少露面的神秘人物—— DeepSeek 的创始人梁文锋进行交流。不一会儿,一个年轻小伙子低着头轻步走进来,他背着双肩包,穿着朴素的运动装,脚蹬一双运动鞋,一声不响地在会议桌的边上坐下了。梁文锋的出现一如他的行事风格,低调而克制,像一位普通的工程师,仿佛与这座随处可见西装革履人士的金融中心格格不入。

随后的几个月里,昇腾团队与梁文锋保持着密切的线上交流。2024 年 9 月和 10 月,华为向梁文锋介绍了昇腾 A3 SuperPoD 超节点架构,强调其通过自研互联协议 " 灵衢 " 实现的高效通信能力。梁文锋对超节点架构表现出浓厚兴趣,认为它能突破传统 GPU 集群的带宽瓶颈。

2024 年 11 月末的一个冬夜,寒风呼啸中,一通电话打破了沉寂:梁文锋亲自致电提出,要把即将发布的 DeepSeek-R1 模型部署到华为昇腾的 A3 SuperPoD 上,并且愿意开放源代码、携手创新。DeepSeek 内部充分分析和评估后,认为华为的 A3 架构,特别是在通信优化上符合 DeepSeek 接下来的布局。

DeepSeek 的模型采用了稀疏专家模型(MoE),拥有 256 个专家单元,再加上 32 个共享专家单元,总共 288 个专家单元。这种架构需要极高效的计算调度和通信能力,而华为的 384 超节点架构,单卡刚好能够容纳全部专家单元,剩余的计算资源还能做冗余专家复用。此外,华为的自研通信技术格外出色。传统的服务器架构往往依赖以太网进行通信,容易在多节点计算时引入较高的延迟,而华为的 384 超节点采用了 " 灵衢 1.0" 总线,能够提供更低延迟的互联方案。

廖恒随即意识到这通电话的重要性。他迅速记录下关键信息,挂断电话后,立刻起身向高层办公室走去。寂静的走廊里,他的脚步声格外清晰,声声回荡,仿佛在宣告一场即将到来的行业变革。这份邀约,让华为高层窥见了足以颠覆行业格局的合作契机。DeepSeek 模型展现出的强大潜力让他们相信,它必将成为昇腾架构的核心合作伙伴。华为商务团队即刻介入,高效推进合规流程,同步统筹调动全量储备资源。技术团队开始对昇腾架构的 A3 SuperPoD 进行最后的调试,确保它能够完美适配 DeepSeek-R1 模型。实验室里,工程师们专注地盯着屏幕,手指在键盘上飞快地敲击着。

2024 年 12 月 3 日夜晚,广州一家酒店的会议室里,暖黄色的灯光洒在大理石地面上,清雅的咖啡香在空气中弥漫。华为团队成员提前抵达,原本,他们与梁文锋约定了晚上 6 点到 7 点商议要事,并共进晚餐。然而,由于行程紧凑,华为团队成员便决定在来酒店的途中在服务区先行用餐。现在,他们围坐在会谈室的一张长桌前,彼此低声交谈,等待着梁文锋的到来。梁文锋独自一人走进会场,他的出现并没有引起太多声响。他依然保持着一贯的低调风格,穿着简单的运动鞋,背着一个朴实的双肩包。他与华为团队深入讨论了技术合作的细节,话语中没有多余的客套,直接切入主题。

大家迅速进入状态,围绕技术细节展开深入讨论。梁文锋将全部精力都放在技术的优化和模型的性能提升上。在会议中,梁文锋提出了一个极具挑战性的技术指标:昇腾 A3 SuperPoD 的性能要达到 100PFLOPS。当梁文锋说出这个数字时,会议室里一片寂静,随后是一阵低语。华为团队成员们的眼睛里既有惊讶,也有被激发的斗志。"100PELOPS?" 华为技术专家之一的张工低声重复了一遍,他的眼神中闪烁着兴奋的光芒," 这是一个前所未有的高度,但我们有信心做到!" 梁文锋点了点头,仿佛早已预料到这个反应。

随着讨论的深入,双方逐渐明确了技术联创的范围。华为团队提出了一系列针对昇腾 A3 SuperPoD 的优化方案,梁文锋则从模型的角度给出建议,确保 DeepSeek-R1 能够充分发挥昇腾架构的优势。在讨论的热烈氛围中,没有人注意到时间的流逝,数小时后会议才结束。梁文锋合上笔记本,背上包,简单地与华为团队道别,然后离开会场,他的身影在酒店大堂里渐行渐远。

终于,2025 年 1 月 20 日,DeepSeek-R1 在全球发布。这款模型性能强悍且全面开源,一经推出便引发全球业界高度关注。而随之而来的,是一场始料未及的热潮,自 1 月 22 日起,DeepSeek 应用的使用量呈几何级数暴涨,海量访问流量如奔涌浪潮般冲击服务器,远超系统预设承载。对于 DeepSeek 来说,其遇到的最大挑战,就是美国对 AI 算力的 " 卡脖子 " 问题。梁文锋曾坦言:" 我们真正的挑战从来不是资金,而是高端芯片的出口禁令。"

危机之际,华为的强势崛起成为 DeepSeek 坚实的支撑。华为高层在紧急会议中拍板,要求海思与华为云全力保障 DeepSeek 应用。当数以万计的用户继续涌入时,华为这盏灯塔就亮在风暴之中,这胜过千言万语。DeepSeek 团队逐渐恢复平稳服务之际,华为团队仍显从容。梁文锋并不急于独占这份荣耀,他更愿意看到整个生态共同成长。华为云工程师们有条不紊地为 DeepSeek 扩容数据库、优化负载均衡,用中国的算力托起中国的创新。窗外的暴风雨可能仍在肆虐,此刻承载着梦想的机房内,却是一派春意盎然的景象。

正是在这样的国产算力与大模型携手破局的发展趋势下,行业格局也迎来了深刻变革。MoE 模型逐渐成为技术主流,大量核心研发力量纷纷转向这条技术路线,行业推理端迎来全面爆发,华为顺势面向运营商、金融、电力、医疗等多个关键行业推出 AI 一体机,而这一波大规模的行业普及浪潮,

很大程度上正是由 DeepSeek 的突破带动的。DeepSeek 的成功,直接让中国开源大模型驶入了发展快车道,国内从事开源大模型研发的人员也借此契机相互学习、取长补短、互通共享,不仅加速了技术迭代速度,更推动了生态共建与经验积累,形成了极强的正向发展循环。这不仅是中国软件发展史上一次具有实质意义的标志性事件,更是中国人在基础软件架构创新领域首次真正意义上获得全球范围的认可。此次 DeepSeek 在基础架构与核心算法层面实现的关键突破,真正为中国的 AI 模型赢得了国际业界的尊重。

这场由 DeepSeek 引领的技术突破并非一蹴而就,而是源于华为与 DeepSeek 长达一年多的深度技术协同。2026 年 DeepSeek 规划开源新一代大模型后,张迪煊、廖恒等核心研发人员便推进与 DeepSeek 的技术对接。DeepSeek V4 预览版于 2026 年 4 月 24 日正式开源,而在此之前,华为已提前向 DeepSeek 研发团队提供了昇腾 950 超节点设备,开展前期适配验证工作。

从前期适配到最终决策,双方的技术磨合与验证贯穿始终,经过一年多的深度沟通与技术验证,梁文锋最终决定将昇腾平台作为算力底座之一。DeepSeek 选择昇腾的核心逻辑,是希望获得华为提供的芯模协同全栈式解决方案与全链路技术保障。此次合作,DeepSeek 将深度使用华为神经网络计算架构(CANN)、昇腾超节点集群等核心技术。

从被动应对算力封锁,到主动构建技术协同,国产算力与大模型的深度融合,正为中国 AI 产业打开通往自主未来的全新大门,其尽头,是一个更开放、更包容、更具韧性的国产 AI 开源生态市场。

多年后回望,这段产业突围的历程,恰似风暴中矗立的灯塔,不仅照亮了国产大模型的自主前行之路,更照亮了中国 AI 生态从跟跑到并跑,再到

引领的未来方向。国产算力与国产大模型的协同共生,将成为中国 AI 产业突破外部封锁、实现自主可控的光辉篇章,点燃无数技术创新与产业落地的梦想。在这盏灯塔的指引下,中国 AI 的星辰大海,正愈加通明而辽阔。

2025 年 8 月 5 日,昇腾的历史转折点

2025 年 8 月 5 日,昇腾计算产业发展峰会在万众瞩目之下拉开帷幕。这次峰会主要有四个目的:首先,产业界对华为有诉求,华为要尽快给产业界反馈;其次,要诚恳地认识自己的不足;再次,要使华为的战略和决心清晰化,向产业界讲述华为具体的落地计划,而不是开空头支票;最后,也是最重要的一点,华为将在峰会上宣布 CANN 全面开源开放。

此次峰会由徐直军做演讲,峰会前一天,徐直军半开玩笑地对专家们说:" 你们怎么写,我就怎么读,但我当着产业界的面说出来之后,你们要给我在一定期限内落地,搞不定就自己‘提头来见’。" 立足产业协同发展的深层逻辑,行业合作客户的核心诉求也为本次峰会的核心举措埋下伏笔:众多客户明确提出,希望华为进一步拓宽开放边界,因华为开放程度的局限,不仅会制约自身技术的迭代,更会放缓华为和客户双向协同的创新步伐。这份来自市场一线的真切反馈,与产业界对开放生态的共同期盼同频共振,进一步推动了华为在本次峰会上宣布开源开放的决心。

峰会当天,徐直军的演讲堪称一场干货满满的思想盛宴。他从华为布局 AI 的战略抉择讲起,深入剖析技术架构的演进历程,并且深刻阐释为何选择性能优先,再攻克应用性的发展路径。在整个演讲过程中,徐直军讲得激情澎湃,将积攒多年的心里话向在场的产业界人士和盘托出。嘴巴讲干了,喝一口水继续讲;讲出了一身汗,干脆脱掉西装接着讲,最后足足演讲了一个多小时。这场真诚的分享,赢得了在场众多客户的高度赞赏。廖恒也对徐直军的这番演讲推崇备至。

不仅如此,昇腾计算产业发展峰会更标志着华为整体战略思想的转变,企业产品正式迈向规模化应用落地,获得了公司高层的全面认可,此前有关金融产品的认知分歧也在峰会上得到了有益的讨论。这场峰会,在华为公司的发展历程中写下了浓墨重彩的一笔。

那么,这一切究竟是如何发生的?关键突破何以实现?昇腾又将引领我们走向怎样的未来?本书历经 6 年深度访谈与潜心撰写,为读者系统呈现这段历程的底层逻辑。昇腾的故事,远比当下所见更为厚重与深远,它不仅记录的是一条产品线的崛起,更镌刻着一家科技企业在时代浪潮中的抉择与坚守。

(本文为浙江大学传媒与国际文化学院常务副院长、中国互联网资深研究者、华为根技术六部曲作者方兴东新书《昇腾崛起》的序言)

相关标签

相关阅读

最新评论

没有更多评论了
新浪财经

新浪财经

新浪财经提供7*24小时财经资讯及全球金融市场报价;覆盖股票、债券、基金、期货、信托、理财、管理等多种面向个人和企业的服务。

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容