G22恒峰

昇腾960提前就绪,华为剑指Agentic AI

9月17日,在华为全联接大会2026上,华为副董事长、轮值董事长汪涛集中展示了面向AI基础设施的新一轮技术进展:昇腾960研发进度提前,NPO光互联产品Hi-ONE即将规模量产,选取NPO技术的昇腾960超节点正式颁布;同时萦绕推算、互联、存储和治理,华为还初次齐全展示了支持超节点集群的11颗关键芯片。 智能体持续工作功夫变长、高低文持续增长以及多智能体并发,使得AI基础设施面对的不再只是NPU算力问题。CPU必要同时处置大量推理工作,存储系统要存储不休扩大的KV缓存,数千甚至数万颗芯片之间还要进行高速通讯。AI基础设施已经起头从单一芯片竞争,转向推算、互联、存储协同的系统工程。 汪涛暗示,华为AI战术的主题仍是算力,将持续萦绕“超节点+集群”进行系统架构创新。截至目前,昇腾910C超节点已经部署超过1000套,昇腾950超节点起头规模商用。 若是说从前几年华为试图回覆的是“若何在单芯片之表获得更大的系统算力”,今年给出的进一步答案则是:通过一整套芯片、光互联、存储和软件生态,把越来越大的AI推算系统进一步衔接起来。 汪涛提到,目前万亿参数级MoE模型持续迭代,10万卡规模的算力集群在成为前沿模型训练的沉要基础设施。但将10万张AI加快卡放在一路,并不料味着10万张卡的算力可能单一相加。 凭据华为测算,在由传统八卡服务器组成的10万卡集群中,模型训练期间芯片之间通讯所亏损的功夫可能超过全数训练功夫的40%,而衡量AI集群有效算力的沉要指标MFU(模型浮点算力利用率)每提升一个百分点,都可能缩短模型迭代周期。 在华为常务董事、ICT BG CEO杨超斌看来,AI基础设施的瓶竟佚转向互联。他暗示,随着模型参数增大、集群规模扩大,一个典型MoE模型在10万卡集群上的MFU可能不到20%;与此同时,Prefill(预填充)、Decode(解码)等阶段的推算和访存特点起头分化,CPU和NPU之间的配比也随分歧场景产生变动。推算系统必要支持异构算力协同、内存池化和分级缓存。 华为超节点的思路,是利用灵衢UnifiedBus统一衔接系统中的分歧组件,支持跨物理服务器统一内存编址,使多个物理节点在逻辑上更靠近“一台推算机”。 萦绕这一架构,华为这次进一步亮出了11颗关键芯片“全家桶”,蕴含鲲鹏CPU、昇腾NPU等推算芯片,面向Scale-Out(横向扩大)的大容量互换芯片,面向Scale-Up(纵向扩大)的低时延互换芯片和高速光互联芯片;存储侧则蕴含介质节造芯片以及专门面向AI KV缓存设计的Smart Storage Unit,此表还有承担系统协和谐治理职能的芯片。这11颗关键芯片共同支持超节点和集群,覆盖推算、互联、存储和治理等重要环节。 汪涛泄漏,昇腾960研发进展快于预期。其中,昇腾960DT支持2 PFLOPS FP8、4 PFLOPS FP4算力,最大支持288GB HBM,访存带宽达到9.6TB/s,打算于2027年一季度筹备就绪,比原打算提前三个季度;昇腾960PR的FP4算力达到8 PFLOPS,打算于2027年三季度筹备就绪,比原打算提前一个季度。 这也意味着,在先进造作工艺受到限度的布景下,华为仍在一连此前的技术路线:一方面提升单颗芯片能力,另一方面通过互联和系统架构,将更多芯片组成更大的推算系统,持续突破AI算力瓶颈。 汪涛指出,当SerDes(串行器/解串器)速度达到224G以上后,铜缆的传输能力会急剧降落;随着NPU数量增长,传统可插拔光?橐材岩月阆低扯曰チ芏鹊男枰。 华为因而将光互联进一步导入算力基础设施中,这次推出NPO(Near-Packaged Optics,近封装光学)光互联产品Hi-ONE,其主题思路与CPO类似,都是尽量缩短高速电信号传输距离、尽早将电信号转换为光信号,但分歧之处在于,NPO没有将光器件和电芯片齐全封装在一路,而是保留独立光引擎。 光互联能力已经被用于华为新一代超节点;贖i-ONE,华为正式颁布昇腾960超节点,单个超节点最大支持4096张昇腾卡,可提供8 EFLOPS FP8算力以及最高1PB HBM容量。 凭据华为测算,昇腾960超节点使用约5500个Hi-ONE?,能够代替原规划约4.8万个800G光?,系统功耗降低超过550千瓦,无故障运行功夫提升一倍,可用度达到99.8%。 英伟达持续以NVLink和NVSwitch推动Scale-Up,AMD、博通等厂商也在萦绕高速互联发展布局。对于华为而言,自研昇腾芯片只是其中一部门,灵衢、互换芯片以及NPO光互联共同决定着数千张甚至数万张卡能否真正形成一套高效能AI算力系统。 传统的大模型交互重要产生在人和模型之间,而多Agent系统必要频仍创建沙箱(给每个Agent工作一时创建的隔离运行环境)、搜索持久影象,并反复挪用模型,这让从前重要萦绕GPU或NPU建设的AI基础设施,同时面对来自CPU、内存和存储的压力。 例如,多Agent系统可能必要实现数十万个沙箱的秒级启动,并实现大量向量检索,华为因而把超节点架构进一步扩大至通用推算。 升级后的鲲鹏超节点选取灵衢全光组网,最大支持4096个节点,并形成最高256TB的统一内存池。凭据华为测试,在十万级沙箱启动场景中,其速度相比传统服务器规划提升30倍,沙箱密度提升25%;在百亿级千维向量检索场景下,系统吞吐最高达到30万TPS。 随着高低文从4K延长至百万Token,以及Agent与模型交互频率持续增长,单张AI加快卡对应的KV缓存容量可能达到TB级。仅依附芯片上的HBM和服务器DRAM已经难以承载,因而必要在集群层面建设PB级KV缓存。 硬件之表,华为也在持续补齐软件生态。截至目前,CANN表部开发者占比已经达到61%,社区月活开发者超过5200人;基于昇腾和CANN原生训练的模型超过40个,CANN已覆盖PyTorch、Triton、vLLM等90多个主流第三方框架及社区,适配超过200个开源大模型。 这也是华为近年来AI算力战术的主线:AI算力的竞争,已经不只是单颗芯片之间的较量,当单颗芯片难以支持大模型对规模算力的需要时,便转向系统级创新——从芯片到超节点,再到万卡、数十万卡甚至百万卡集群,并进一步覆盖CPU、存储、网络与软件生态。

关键词:昇腾960提前就绪,华为剑指Agentic AI · 更新于 2026-09-19 02:20:13 · 本页 /desnewsUG4Bi9alsT

Opta推算欧联夺冠概率排行:伯恩茅斯居首,尤文第6,米兰第8

蒂亚戈-席尔瓦:46岁的法比奥本应该入选巴西国度队

李幼虎20260919 · 5分钟阅读

五角大楼汇报:美在中东基地和表交机构受沉大损失

“豆包手机”来了!有哪些不一样?

张国太20260919 · 7分钟阅读

半。捍罅锍1-0孝感,高海生传球失误,汉森远射破门

AI“持续进建”或开启存储新周期!花旗:HBM、服务器DRAM及eSSD需要齐升 欠缺或持续至2031年

张桂贞20260919 · 4分钟阅读

AI模型发现人体钟装隐形”蛋白质TM184C

威尔士欧国联名单:本-戴维斯领衔,布伦南、阿姆帕杜在列

李红20260919 · 5分钟阅读

创近两年来IPO审核最快终止纪录,申报创业板上市仅三个半月,久易股份二闯A股缘何又当“逃兵”?

Anthropic偷偷建起生物尝试室!Claude指挥机械人做尝试,AI造药再进一步

吴万晓20260919 · 7分钟阅读

队报:雷恩正式对赛程调换进行申述,不愿客场再战巴黎

阿斯:队医建议罗德里戈明年1月复出,但他但愿赶上12月国王杯

乔幼国20260919 · 9分钟阅读

“数字性命”背后的智能生物传感丨两说

组委会回应一中学生作文大赛特等奖文章被指剽窃:还在调查,还没有结论

张幼琴20260919 · 8分钟阅读

苹果已赞成从 2027 年第一季起 以更高价值采购 RAM 芯片

上海海港破294天亚冠球荒!安佩姆3分钟2球,武磊助攻,敌手超巨失误

迟万辉20260919 · 2分钟阅读

男足险胜朝鲜!董路质疑安东尼奥:朝鲜要有赵松源 中国队得输糊涂

华曙高科:自主研发铜合金3D打印规划 破解液冷散热难题

赵永20260919 · 3分钟阅读

刚刚,巴中时期回应车企“自研电池”:会造车不愿定会造电池

19岁少女惨死在自家幼卖部,眷属10年后才知主犯改判死缓,最新细节:凶手姐姐曾隐匿其血衣、赞助出逃;眷属:所有做错事的人都应支出价值

杨秀君20260919 · 9分钟阅读

《兰香如故》演员演技排名,谭松韵第4,李梦第3,第1毋庸置疑

“就美国而言,这三场战争拥有决定性意思”

张振英20260919 · 9分钟阅读

德约时隔11年沉返中网遭扎心提问,郑钦文从武网资格赛奋起?

七地探路,真金白银,广东怎么把“算力”卖全球?

白立刚20260919 · 3分钟阅读
【网站地图】