华为发了个「光模块杀手」:昇腾960 超节点跟你的机房电费有什么关系
9 月 17 日,第十一届华为全联接大会(HC2026,主题"智启新未来")在上海开幕。首日主题演讲环节,华为发布了昇腾960 超节点——据官方口径,这是全球首个采用 NPO(近封装光学)技术的超节点,面向十万亿参数规模大模型的训练与推理。单超节点可扩展至 4096 卡(NPU)、算力 8 EFLOPS(FP8),最大支持百万卡集群;同场还有鲲鹏超节点升级与灵衢 UnifiedBus 系列化套片(一句带过不展开)。另有一条时间线信息:昇腾960 芯片上市时间提前约 9 个月,至 2027 年一季度。
这台机器离中小企业的采购清单很远,但它内里的一项变化,跟所有自建机房的企业都有关系。用三组数字拆开看。
三组数字:光模块去哪了
第一组,替代比。 官方口径:约 5500 个 Hi-ONE 互联单元,替代了约 4.8 万颗 800G 光模块。传统集群里,加速卡之间靠交换机和光模块两两相连,卡数一多,光模块数量就爆炸式增长——它是大型 AI 集群里数量最多、功耗可观、故障率也排名靠前的部件。NPO(近封装光学)做的事,是把光互联从"板卡上插光模块"挪到"芯片封装旁边",距离更短、器件更少。
第二组,功耗。 上述替代带来系统功耗降低超 550 千瓦——这是一个超节点级别省出来的电与热,配套的还有正交架构与全液冷设计。
第三组,可用度。 系统无故障运行时间提升一倍、可用度 99.8%,RTT 时延最低 2 微秒。光模块少了,故障点就少了——对"训练一跑几十天、中断一次重来"的大模型业务来说,可用度比峰值性能更值钱。
跟你的机房电费有什么关系
有三层。
第一层,账本思维变了。今天(9 月 18 日)大会第二日的 AIDC 基础设施峰会,主题就叫"让每一瓦特产出更多 Token"——能效已经从"省电费"的附属话题,变成算力基础设施的第一叙事。
第二层,成本会传导。国家级大规模算力的建设与运营成本下降,最终会沿着"智算中心→算力租用价格→企业用 AI 的成本"这条链传导下去。中小企业不需要买超节点,但会用越来越便宜的方式,租到这些超节点跑出来的算力。
第三层,技术会下渗。全液冷、高密度部署、光进算力底座这些"国家队"级技术,通常两三年内会出现在园区级与企业级产品里。企业自己的机房改造、设备换代,值得把"散热方式与互联架构"提前列进问题清单。
顺带把这两天串起来看:前一天的坤灵发布会,华为发的是中小企业办公全家桶(那场已单独拆解过);这场发的是国家级算力底座。从"小办公"到"大算力",一周之内两条线都压上了资源。
对贵州企业意味着什么
贵州本就是算力基础设施的重点布局区域,本地企业上 AI 的正确姿势不是数卡,而是算"每元算力产出"。超节点们把大规模算力的成本曲线往下压,传导到租用侧,就是企业用 AI 的门槛持续下降——今天用不起的场景,明年可能就用得起。另一面,自己有机房的企业,电费与散热的账每年都在涨:把"每一瓦特产出多少"当成机房管理的常规指标,是这次大会最值得抄走的思路。
实操三件事
一、租算力先问能效与利用率口径。 比较算力租用方案时,除了规格,把"实际利用率保障、能耗与散热口径"一起问清——同样的卡,利用率差一截,成本就差一截。
二、自建机房把电费当 KPI。 做一次机房盘点:设备功率、电费分摊、散热瓶颈各列一张表;换新设备时把能效参数与散热要求写进采购标准。
三、技术下渗写进选型清单。 未来两三年的大额 IT 采购,多问一句"这台设备的互联与散热架构是什么"——今天的超节点技术,就是明天园区机房里的常规配置。
大会还在进行,后续分论坛的成果与中小企业视角解读会继续跟。算力成本与机房能效这些实事想在本地落地的,可以搜「贵州诚鑫致达」。
信息来源:华为官网、C114