• 正文
  • 相关推荐
申请入驻 产业图谱

海光双芯加速方案,如何助力运营商词元经营?

9小时前
176
加入交流群
扫码加入
获取工程师必备礼包
参与热点资讯讨论

运营商大举布局AI 算力基础设施之后,下一道必须答好的考题是什么?

我认为,不是继续扩大算力规模,也不是跟进最新的大模型参数,而是如何把沉淀在机柜里的算力,转化为可计量、可盈利、可持续的业务收入。换句话说,就是怎么做好词元经营这门生意。

在2026 中国联通合作伙伴大会上,海光信息正式推出面向词元经营的双芯加速解决方案,给出了国产算力视角下的解题思路。这套方案跳出单纯的硬件性能比拼,围绕词元从生产到复购的完整价值周期搭建能力框架,将算力组网、大模型训练推理、智能体调度与运营纳入统一架构,试图帮运营商把算力真正运营起来。

- 01 -从算力建设到算力经营,运营商的新考题

过去几年,运营商加快算力网络布局,AI 算力规模快速增长。但随着基建逐步到位,行业普遍开始面对一个现实问题:有算力不等于有效益。

很多地方的AI 业务还停留在资源出租的阶段,按机柜或按卡收费,赚的是基础资源的差价。这种模式下,算力投入和业务收入之间没有精细的对应关系,词元生产多少、成本多少、损耗在哪,很难算得清楚。

更深层的矛盾在于,词元的完整链路当前并没有很好串联起来。生产、调度、计量、成本核算、应用变现、复购扩容,各个环节往往对应不同的系统、不同的团队,数据不通,标准不一。前端业务要上线一款AI 服务,后端要反复协调资源;想要核算单客单业务的收益,往往要靠人工拆分统计。

这也意味着,运营商的AI 发展正在跨过第一个阶段,从算力建设周期进入价值经营周期。接下来的竞争核心,不再是谁的算力存量更大,而是谁能把每一个词元的生产效率提上去,成本控下来,价值打出来。

- 02 -双芯协同,打通词元经营全链路

海光这套方案的核心逻辑,是用CPU 加 DCU 的双芯组合,支撑词元全周期的经营需求,而不是只解决某一个环节的计算问题。

其中,海光CPU 承担智能调度中枢的角色,发挥拓扑感知的优势,统筹资源编排、工具调度和记忆管理等复杂任务,智能对齐内存分配与节点布局。海光 DCU 则作为加速计算引擎,主要负责并行计算、P/D 分离优化、批量解码、KV 缓存优化、预处理加速以及长序列高效处理。

两者不是简单的叠加,而是通过数据协同和内存协同机制,实现业务流量的智能分流与动态调度。不同类型的任务分配到最合适的计算单元上,高峰时灵活扩容,低谷时减少闲置,让整个算力池的运转效率匹配真实的业务波动。

放在词元经营的完整链条里看,这套架构覆盖了从生产到扩容的全部环节。词元生产阶段,DCU 提供稳定高效的并行计算能力,保障产出吞吐;调度阶段,CPU 统筹全局资源,根据业务优先级动态分配算力;计量与成本核算阶段,统一的架构支撑更精细的颗粒度统计,让每一个词元的消耗都可追溯;到了应用变现和复购扩容阶段,标准化的算力底座可以快速支撑新业务上线,也可以根据业务增长平滑扩充能力。

对运营商来说,这种设计的好处是贴合实际业务场景。不管是面向C 端的智能客服、内容生成,还是面向政企客户的大模型服务、行业解决方案,都可以在这套统一架构上运行,不用为不同业务单独搭建算力底座。

- 03 -不止是芯片,是系统级的运营能力

很多人看算力方案,首先看单卡的性能指标。但对运营商而言,真正决定经营效率的,是整套系统的协同能力。

海光这套方案的思路,是从单卡性能竞争走向系统级协同,整体覆盖硬件基础层、集群系统层、软件生态层和服务运营层四个层级。每一层都对应运营商实际运营中的不同需求,从底层硬件到上层服务形成完整的闭环。

支撑这套体系的,是四个维度的开放能力。

算力开放,支持双芯原生组合,也支持异构芯片交叉适配,可以根据不同的并发规模和词元生产场景灵活搭配,不用被单一硬件架构绑定。

互连开放,基于自研的HSL 高速互连协议,突破芯片间的数据带宽瓶颈,大幅提升数据流转效率。对大规模集群来说,互连效率直接影响整体算力的有效输出,这也是词元规模化生产的关键基础。

安全开放,内置芯片级的内生安全能力,为词元经营的全链路提供可信防护。运营商的业务涉及大量用户数据和政企信息,安全是底线,也是开展经营的前提。

软件栈开放,全栈开发工具链适配百余种主流AI 框架,降低业务迁移和开发的门槛。对运营商来说,生态适配成本往往是一笔隐形的大投入,开放的软件栈可以明显缩短业务上线周期,也减少后续的运维成本。

换句话说,这套方案提供的不是几块芯片,而是一套可以直接用在经营场景里的算力运营体系。

- 04 -算清三本账,看懂方案的实际价值

对运营商来说,判断一套算力方案好不好,最终还是要落到经营账上。具体来看,就是效率、成本、增长这三本账。

第一本是效率账。统一的双芯调度架构,可以有效降低算力闲置率,提升单集群的词元产出能力。同时一体化的架构简化了运维流程,不同业务不用重复搭建和调试环境,新业务上线的周期可以明显缩短,更快响应市场需求,加速AI 要素向业务端流转。

第二本是成本账。这套方案支持词元级的精细计量,每一个词元的算力消耗都可以精准核算,这就为业务的精细化定价和成本管控打下了基础。更重要的是,它支持现有CPU 算力的利旧,运营商可以在保护已有投资的基础上,逐步叠加 DCU 实现平滑扩容,不用一次性推倒重建,大幅降低整体建设的总拥有成本。统一调度还可以盘活分散在各地的算力资源,减少重复建设带来的浪费。

第三本是增长账。有了完整的词元经营能力,运营商就可以从单纯卖算力资源,转向卖分层分级的AI 服务。面向不同行业、不同规模的客户,推出不同规格的词元服务产品,打开更大的收入空间。而且这种模式是可持续的,从一次性的硬件采购收入,转向持续的运营服务收入,形成更稳定的增长曲线。

- 05 -生态共建,支撑长期平滑演进

算力经营不是靠一家厂商就能做完的事,最终还是要靠完整的产业生态。

海光的思路是依托光合生态,联合整机、基础软件、行业应用等上下游伙伴,持续推进产品适配和联合创新。推动国产CPU、DCU 以及各类异构加速硬件实现统一调度、协同运行,给运营商和行业用户提供更灵活的选择。

对运营商而言,灵活度很重要。不同省份、不同业务的发展节奏不一样,算力需求也千差万别。开放的生态意味着不用绑定单一厂商的路线,可以根据自身的业务节奏,分阶段建设,平滑扩容。既可以充分利用现有的硬件资源,也可以在需要的时候快速引入新的能力,保护长期投资。

国产算力走到今天,已经不再是有没有的问题,而是好不好用、能不能赚钱的问题。只有真正贴合运营商的经营需求,能帮业务落地、帮收入增长的方案,才能在规模化应用中走得更远。

运营商的AI 竞赛,正在从上半场的算力规模比拼,进入下半场的经营效率比拼。

词元经营听起来是个新概念,本质上就是算力的精细化运营。谁能把词元的生产效率提得更高、成本算得更清、业务做得更活,谁就能在算网融合的浪潮里占据主动。

海光这次发布的双芯加速方案,是国产算力厂商向运营场景深度下沉的一次尝试。它没有停留在硬件参数的宣传上,而是站在运营商的经营视角,把技术能力转化成了可落地的效率提升、成本优化和增长空间。

接下来,随着更多场景的落地和生态的完善,这套方案能不能帮运营商真正把算力运营起来,或许会成为行业观察国产算力价值的一个重要样本。

海光信息

海光信息

海光信息技术股份有限公司成立于2014年,主要从事高端处理器、加速器等计算芯片产品和系统的研究、开发,目标成为中国最重要的计算机芯片设计企业,为中国信息产业的强盛提供核心计算引擎。作为国产先进微处理器产业的推动者,海光公司以务实的态度、创新的理念、先进的技术和可靠的产品,致力于促进我国信息产业核心竞争力的提升。

海光信息技术股份有限公司成立于2014年,主要从事高端处理器、加速器等计算芯片产品和系统的研究、开发,目标成为中国最重要的计算机芯片设计企业,为中国信息产业的强盛提供核心计算引擎。作为国产先进微处理器产业的推动者,海光公司以务实的态度、创新的理念、先进的技术和可靠的产品,致力于促进我国信息产业核心竞争力的提升。收起

查看更多

相关推荐

公众号:白犀牛通信,一群有理想、有力量的通信从业者。专注5G、算力网络、智慧中台、云计算。