【CBI观察】从全联接到云栖,昇腾与平头哥的路线分野

作者: 李祥敬

责任编辑: 李祥敬

来源: CBISMB

时间: 2026-09-22 14:38

关键字: 华为 昇腾 阿里巴巴 平头哥

浏览: 440

点赞: 26

收藏: 5

相隔不到一周,华为全联接大会2026与阿里云栖大会2026先后交出新一代AI芯片答卷。

同样锚定Agent智能体时代,同样将新品量产窗口锁定在2027年Q1,但昇腾和平头哥走出了两套截然不同的叙事:一套向外构建开放产业生态,一套向内打磨云-芯片-模型一体化闭环。

昇腾和平头哥在2026年两场大会上,共同把讨论焦点从“单卡跑分”推向了系统、集群、智能体工作负载。二者都判断:未来算力瓶颈不再只是芯片本身,而是芯片互联、存储IO、CPU调度、长上下文记忆、多智能体协同构成的全链路。但实现路径,走向了分叉。

一、芯片硬件:同时间窗口量产,架构设计思路差异明显

华为在2026全联接大会上公布昇腾960系列:昇腾960DT定档2027 Q1,较原计划提前三个季度;昇腾960PR在2027 Q3落地,性能较昇腾950实现翻倍。

昇腾960超节点是业界首个采用NPO近封装光学技术的集群方案,单超节点4096卡规模,FP8总算力8EFLOPS,HBM总容量1PB。

依靠Hi-ONE光互联替代传统光模块,大幅降低大规模集群功耗与故障率,系统可用度提升至99.8%。

昇腾明确提出“τ定律”,后续保持一年一代迭代节奏,规划昇腾970(2028)、昇腾980(2029),持续同步提升算力、访存、互联带宽。

平头哥在云栖大会正式发布真武V900训推一体芯片,同样锁定2027 Q1量产。V900算力为真武M890的3倍,搭载216GB HBM显存,片间互联带宽1200GB/s,原生支持FP8、FP4低精度计算。搭配自研ICN Switch互联芯片,实现千卡全带宽协同、统一内存编址;搭载V900的磐久AL128超节点服务器,单集群最大可扩展至50万卡。

从硬件设计取舍来看:

昇腾的重心放在跨节点光互联(NPO),用全新光电融合架构解决万卡级集群的功耗、布线、可靠性难题。昇腾体系是灵衢UnifiedBus统一总线,将昇腾NPU、鲲鹏CPU、存储、交换芯片纳入同一总线体系,强调异构硬件的统一协同。

平头哥的真武V900,则延续ICN芯片间互联的电互联路线,优先放大单卡显存容量与片间带宽,面向大模型长上下文、智能体持续记忆这类高显存负载;同时补齐倚天CPU、镇岳存储主控、磐脉网卡,构建完整算存网自研芯片矩阵。

一个细节:昇腾960超节点是4096卡作为一个基础超节点单元;平头哥AL128以128卡为基础超节点,向上一直扩展到50万卡集群。二者的超节点最小单元规模设计,也反映出各自对集群调度模型的理解。

二、软件栈与生态:开放生态vs云原生一体化

硬件之外,两条路线最大分水岭在于软件生态。

昇腾的核心策略是开源开放,做大产业底座。CANN持续开源,升级昇腾C编程模型,开放PTO指令集,推出CANNBot、Model Agent、MindStudio Agent等一系列智能体工具链,面向开发者、政企、科研机构。昇腾生态已经深度渗透到政企、高校、智算中心,大量第三方服务器厂商、模型公司、行业ISV基于CANN开发应用。昇腾的定位,是作为独立算力基础设施,供给给全行业客户,不绑定单一云平台。

华为在全联接大会强调Agentic Infra,提出智能体五大维度计算架构,配套CMS记忆存储模组,专门解决Agent长记忆读取痛点。昇腾集群大量落地在外部智算中心,很多项目并非华为云自用,这是昇腾生态最核心特征。

平头哥的路线是云、芯片、模型三位一体闭环。平头哥芯片、SAIL软件栈、磐久服务器、CPFS存储、通义千问大模型、AgentCore智能体平台全部出自阿里体系。真武芯片从设计之初就优先适配阿里云云原生、Agentic Cloud工作负载,通义大模型、企业智能体平台可以和真武、倚天做深度联合调优。

平头哥并非不对外开放,真武M890已经落地650家企业客户,覆盖20多个行业,累计出货56万片。但平头哥的核心优势场景,是阿里云内部智算集群、云上客户,软硬件联合优化的红利优先释放给云内业务。

倚天CPU路线图更新,专门面向Agent任务调度:倚天720主打大规模Agent并发编排,倚天730面向智算集群Head Node,远期倚天750原生支持ICN总线,可与真武芯片直连,降低CPU-NPU通信开销。这套CPU+NPU+存储+网卡全自研组合,是平头哥独有的体系。

简单概括:昇腾做通用国产算力底座,生态向外生长;平头哥做智能体原生云底座,软硬栈深度内耦合。

三、商业化与落地场景:生产级集群与Agent云原生场景

昇腾已经走过大规模商用爬坡期。昇腾950超节点已经进入规模化商用,上千个昇腾910C超节点完成部署,大量万卡集群落地于国内各地智算中心、科研与工业项目。

昇腾擅长服务大型静态训练任务、行业大模型、政企离线推理,系统稳定性、故障恢复能力经过大量生产场景验证。

华为在大会重点强调集群长期稳定运行能力,故障快速恢复机制,这是政企客户采购算力最看重的指标。

平头哥的商业化重心正在从阿里云内部验证,转向行业客户规模化复制。M890已经可以稳定支撑2万亿参数大模型训练,V900瞄准5~10万亿参数通义模型训练,核心场景转向企业Agent、多智能体并发、长上下文业务。这类负载的特点不是一次性超大模型预训练,而是海量智能体持续调度、频繁读写上下文,CPU、存储、网络开销占比显著提升。这也是平头哥坚持补齐倚天CPU、镇岳存储主控的底层原因:Agent workload,CPU不再只是辅助,而是智能体任务调度的核心。

二者都看好智能体,但对智能体的场景理解存在差异:

昇腾视角:智能体是跑在通用算力集群之上的应用,底层算力基础设施要足够开放、稳定、兼容各类模型与行业软件。

平头哥视角:智能体重构了算力负载,底层芯片、服务器、存储、云平台必须重新协同设计,整套基础设施原生为Agent而生。

四、国产算力的不同发展路径

昇腾代表独立芯片生态路线:芯片与软件栈独立发展,供给全行业,第三方伙伴共同构建生态,适合全国智算网络、政企行业落地。它的挑战在于持续扩大软件生态兼容性,降低开发者迁移成本。

平头哥代表云厂商全栈自研路线:芯片为云服务、大模型、智能体平台服务,全链路协同优化,把芯片价值通过云产品交付给客户。它的挑战在于持续扩大外部客户占比,证明这套全栈方案不只是阿里自用,也能适配多样化企业场景。

两条路线面对共同课题:提升良品率、稳定量产交付、完善低精度算子、优化集群通信效率,持续降低客户使用成本。

最根本的是国产算力不再只追求单卡对标海外产品,而是转向系统级能力竞争。

此前行业比拼的是单卡算力、显存;现在比拼的是集群互联、全栈软件、智能体场景适配能力。昇腾以开放生态、NPO光互联构建通用算力底座;平头哥以算存网全栈自研、云模芯一体化,打造Agent原生算力。

两条道路并无优劣之分,本质是两种商业模式下的技术取舍。

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。
地址:北京市朝阳区北三环东路三元桥曙光西里甲1号第三置业A座1508室 电话:13391790444或(010)62178877
版权所有:电脑商情信息服务集团 北京赢邦策略咨询有限责任公司
声明:本媒体部分图片、文章来源于网络,版权归原作者所有,我司致力于保护作者版权,如有侵权,请与我司联系删除

京ICP备:2022009079号-2

京公网安备:11010502051901号

ICP证:京B2-20230255