• 正文
  • 相关推荐
申请入驻 产业图谱

平头哥的“系统级”突围:真武V900发布背后的国产算力竞争逻辑之变

原创
10小时前
561
加入交流群
扫码加入
获取工程师必备礼包
参与热点资讯讨论

2026年的国产AI算力赛道,正在经历一场竞争逻辑的深层切换。

过去几年,行业讨论的核心往往围绕单颗芯片的峰值算力、制程节点和能效比展开,“对标某国际大厂”是常见的叙事方式。但随着大模型参数从千亿迈向万亿、Agent应用将上下文窗口从256K推至1M甚至更高,行业逐渐意识到,单芯片的算力天花板已经很难独立支撑前沿模型的训推需求。与此同时,生态层面的现实更加棘手:数百万开发者深度绑定CUDA生态,不同国产芯片之间“一芯一栈”的烟囱式格局普遍存在,芯片替换往往牵涉开发框架、算子库、调试工具等一整套技术栈的系统迁移-。有分析指出,从CUDA生态迁移至国产平台的成本,部分项目的时间和投入至少增加50%,国产替代的瓶颈更多体现在开发生态而非芯片性能本身。

这一局面意味着,AI芯片竞争已经进入“深水区”——胜负手不再只是单芯片的算力参数,而是芯片、互联、存储、软件、生态之间能否形成系统级的协同闭环。中信证券在近期研报中明确判断,国产算力正从单点硬件竞争演变为“芯片-互联-存储-OS-生态”的全生态对抗,系统级高效率成为核心竞争力-。换句话说,这是一场从“单卡性能”到“系统效率”的范式迁移。

正是在这一背景下,平头哥在2026年杭州云栖大会上的发布,释放出了值得关注的产业信号。

9月22日,平头哥发布了新一代训推一体AI芯片真武V900,算力提升至上一代M890的3倍,搭载216GB显存,片间互联带宽达1200GB/s,原生支持FP8、FP4低精度计算。但真正值得审视的,是这次发布所呈现的系统性:与V900一同亮相的还有新一代磐久超节点服务器,集成真武V900、ICN Switch高速互联芯片、磐脉智能网卡、镇岳SSD主控四大自研芯片,结合阿里云新一代网络架构,单一AI集群可扩展至50万卡规模。此外,平头哥首次公布了倚天服务器CPU的迭代路线图,倚天720和倚天730定档2027年,后者将搭载平头哥首款全自研CPU微架构,后续的倚天750还将原生支持ICN片间互联总线协议,与真武AI芯片实现总线级直连互通。

平头哥新一代训推一体AI芯片真武V900发布

从AI芯片到互联芯片、智能网卡、SSD主控,再到CPU路线图,平头哥在这一次发布会上亮出的,是一张“存-算-网全栈”的底牌。它所回应的,正是深水区竞争的核心命题:在单芯片参数之外,国产算力能否在系统层面建立起足以支撑万亿参数模型规模化落地的协同效率。

芯片迭代提速背后:算力需求的结构性变化

真武V900的发布节奏本身就值得注意。

上一代真武M890于2026年5月首次亮相,搭载144GB显存,片间互联带宽800GB/s,支持FP32到FP4多精度计算。仅仅四个月后,V900便将单芯片性能提升至M890的三倍,显存增至216GB,互联带宽提升至1200GB/s,并原生支持FP8、FP4低精度计算。

这种迭代速度在芯片行业并不常见。其背后的驱动力,是大模型技术路线和推理负载正在发生的结构性变化。

一方面,万亿参数大模型逐渐成为常态,MoE架构几乎成为所有主流大模型的技术选择。MoE通过稀疏激活让每个Token只调用部分“专家”,在扩大参数规模的同时控制单次推理的计算量,但代价是“专家”分布在不同的AI芯片上,Token需要在芯片间频繁路由,由此产生大量All-to-All通信。这意味着互联带宽和时延正在成为制约集群效率的关键瓶颈。

另一方面,Agent浪潮进一步改变了推理负载的形态。Agent在执行复杂任务时可能经历规划、推理、调用工具、读取数据、再次推理等数十轮循环,上下文窗口突破百万级,KV Cache持续膨胀,多Agent协同带来海量并发请求。有分析指出,衡量算力基础设施性能的核心公式,已经从过去单一的算力指标,变成了“算力×内存×互联”。

真武V900的三项核心升级——低精度算力、大显存、高互联带宽——对应的正是这三个方向。按照平头哥公布的计划,V900将于2027年第一季度量产售卖,下一代真武J900则计划在2028年Q3推出。

超节点:从“堆卡”到“一台计算机”

如果说V900芯片解决的是单卡能力天花板的问题,那么超节点服务器的推出,针对的则是另一个层面的瓶颈。

平头哥半导体副总裁高慧在演讲中指出,真正的超节点核心不是堆叠多少张卡,而是“消除服务器的物理边界,让大量芯片在系统语义上如同一颗芯片协同工作”。这一判断触及了当前国产算力集群的一个深层问题:许多所谓超节点,本质上是通用服务器堆叠加上RDMA以太网组网,跨节点内存隔离、缺少原生内存语义、算力资源碎片化,导致大规模集群的模型算力利用率(MFU)显著下降。

平头哥的解法是在底层芯片层面做协同设计。全新升级的磐久超节点服务器集成了真武V900、ICN Switch高速互联芯片、磐脉智能网卡、镇岳SSD主控四大自研芯片,依托自研ICN互联架构实现原生内存语义与统一内存编址,使上千颗真武V900能够如同一颗“超级芯片”协同运转。结合阿里云全新智算中心网络架构,单集群可弹性扩展至50万卡规模。

值得注意的是,这一代超节点并非凭空而起。上代基于真武M890搭建的超节点已实现规模化商用,并跑通了Qwen3.8、Kimi K3等超2万亿参数大模型,这为V900超节点的工程落地提供了可参照的验证基础。

从行业视角看,超节点正在成为国产算力突围的重要方向。中金公司分析认为,2026年有望成为国产超节点放量元年,产业正从概念验证进入批量交付阶段。在这一方向上,华为以昇腾960超节点和自研灵衢互联协议走的是“超节点+集群”路线,单节点可扩展至4096卡;平头哥则以ICN Switch和自研ICN协议为底座,走的是从芯片到系统的全栈协同路径。两条路线在技术理念上有相似之处——都强调统一内存编址和内存语义——但在芯片生态和系统实现上各有侧重。

倚天CPU的“配角转主角”:Agent时代的系统级思考

此次发布会另一个值得关注的信号,是倚天服务器CPU迭代路线的首次公开。

高慧提出了一个行业判断:在Chatbot时代,CPU更多承担调度等辅助工作;但进入Agent时代,工具调用、代码沙箱、多轮任务编排、多路结果汇总等大量核心工作落在CPU侧,“CPU已经走到业务的关键路径上”。

这一判断指向了CPU在AI算力系统中角色的变化。Agent类工作负载的特点是任务链长、状态管理复杂、对单核性能和内存带宽敏感,而这些恰恰是通用AI加速芯片不擅长处理的环节。

平头哥公布的路线图显示,2027年将推出倚天720和倚天730两代产品。倚天720面向Agent大规模并发场景,以192核规格实现核密度和能效的全面提升;倚天730则搭载平头哥首款全自研CPU微架构,单核SPECint 2017/GHz性能最高可达倚天710的1.4倍。后续的倚天750将支持ICN片间互联总线协议,可与真武AI芯片通过ICN总线直接互联,消除CPU与AI芯片之间的数据交互壁垒。

更值得关注的是,从倚天720开始,平头哥的CPU将部署进磐久超节点,成为其中的“第五颗自研芯片”。这意味着平头哥的超节点方案正在从“四芯协同”走向“五芯全栈”,核心芯片的全自研程度进一步加深。

从产业角度看,这一布局回应了当前国产ARM服务器CPU面临的几个共性困境:迭代断层、依赖公版架构、与AI芯片适配困难。平头哥选择将CPU纳入自研体系并与其AI芯片通过统一总线协议互联,走的是一条系统级适配的路线,而非单纯的CPU性能竞赛。

中立视角下的挑战与变量

在肯定平头哥全栈布局战略意义的同时,也有几个问题值得冷静审视。

其一,量产交付能力。 真武V900计划2027年Q1量产,倚天720/730同样定档2027年。从发布到量产之间,良率、产能、供应链等工程层面的挑战不可低估。

其二,生态迁移的实际门槛。 平头哥在软件层面采取了兼容主流生态的策略,其SAIL软件栈已于2026年7月全面开源,涵盖SDK、内核驱动、编译器调试器和高性能计算库等核心组件。官方称开发者最快可在一周内完成迁移适配。但CUDA生态近二十年的积累,其工具链成熟度、开发者社区规模、框架适配深度,并非短时间内可以完全对标。生态迁移的成本和时间,仍然是所有国产AI芯片厂商共同面对的核心变量。

其三,市场竞争格局的演进。 在国产AI加速卡市场,华为昇腾占据领先地位,平头哥凭借真武系列的出货量已跃居国产厂商前列。但随着华为昇腾950PR等产品在CUDA兼容性上的持续投入,以及更多国产芯片厂商的进入,市场竞争的烈度只会进一步上升。

其四,标准与开放性的平衡。 平头哥的ICN协议、华为的灵衢协议,都是各自体系内的私有互联方案。这些方案在系统内部实现了高效协同,但也可能在更大范围的产业互联中形成新的壁垒。如何在“自研体系效率”与“产业生态开放”之间取得平衡,是一个需要长期回答的问题。

结语

从2018年成立至今,平头哥走过了八年。从含光系列推理芯片到倚天710服务器CPU,再到真武系列训推一体芯片和如今的“五芯”超节点布局,其路径逐渐清晰:不追求单点指标的极致,而是试图在芯片、互联、系统、软件之间建立协同效应。

这一路径的合理性,建立在一个基本判断之上:大模型和Agent时代的算力竞争,胜负手不在单颗芯片的峰值算力,而在整个计算系统能否以更低的成本、更高的效率持续产出有效结果。正如高慧所言,“衡量一套AI基础设施,不只是看它能训练多大规模模型,更要看它能以多低的成本、多快的速度,为真实任务持续产出高质量结果”。

这个判断是否正确,最终将由市场来检验。但至少从当前的产业趋势来看,从“单卡性能”走向“系统协同”,已经成为国产算力突围的一条共识路径。平头哥能否在这条路径上跑出差异化优势,2027年的量产交付将是第一个关键节点。

来源: 与非网,作者: 高扬,原文链接: https://www.eefocus.com/article/2094718.html

平头哥

平头哥

平头哥半导体有限公司于2018年9月宣布成立,是阿里巴巴集团的全资半导体芯片业务主体。平头哥拥有端云一体全栈产品系列,涵盖数据中心人工智能芯片、处理器IP授权等,实现芯片端到端设计链路全覆盖。

平头哥半导体有限公司于2018年9月宣布成立,是阿里巴巴集团的全资半导体芯片业务主体。平头哥拥有端云一体全栈产品系列,涵盖数据中心人工智能芯片、处理器IP授权等,实现芯片端到端设计链路全覆盖。收起

查看更多

相关推荐

与非网总编。所知有限,不断发现。抱持对技术、产业的热情和好奇,以我所知、所见,真实还原电子产业现状和前沿趋势。

微信公众号