• 正文
  • 相关推荐
申请入驻 产业图谱

十万卡的“真假命题”:当国产算力不再困于机房

22小时前
199
加入交流群
扫码加入
获取工程师必备礼包
参与热点资讯讨论

2026年7月17日,上海世博展览馆H2馆B116展台,曙光8000(登峰)真机首次面向全球公开亮相,获评WAIC 2026“镇馆之宝”。

展台前人头攒动。人们关注的不仅是这个“庞然大物”本身,更是它背后的一条信息:7月9日正式上线,首周即需求爆满,应用满载运行,日均处理作业数突破15万个,最高单日峰值超50万。

当业界还在争论“十万卡是否有必要”,曙光8000已经用十万张卡的“完整出勤率”揭示了另一个更本质的现象——国产算力正在完成从“能建”“能用”到“好用”“抢着用”的历史性转折。

| 验证的不只是规模,更是系统成熟度

过去几年,算力中心“建得快、用得慢”并非秘密。不少智算中心建成后利用率长期在50%以下徘徊,十万卡更多停留在“纸面参数”。

曙光8000的不同在于:它不是样机,是生产环境验证过的系统。上线首周即应用满载,这背后是实实在在的工程能力在支撑。

从万卡到十万卡,挑战远超数量级的增长。曙光8000包含约30亿个部件,任何微小波动都可能影响整体运行。中科曙光高级副总裁李斌坦言,从万卡到十万卡“确实有很多挑战,不是简单乘10倍”,最大的难点在于性能和可靠性能否随规模同步提升。

答案已经给出:百亿级部件协同、毫秒级链路故障自愈、99.99%系统可用性、PUE低于1.04——这些不是“堆卡”能实现的,是系统工程能力的及格线。

从2024年完成系统研制,到2025年启动建设,再到今年7月曙光8000的落地,这个节奏本身就说明:大规模国产算力集群已经具备可规划、可分阶段验证、可复制的工程能力。 发布当天,中科曙光即与北京科学智能研究院达成战略合作,启动第二套十万卡系统的研制与建设。十万卡不再是“一次性工程”,而是开始走向“标准化产品”。

| 芯片强不等于集群强

WAIC现场,曙光8000展台与阿里巴巴“真武M890×磐久AL128超节点”、中兴通讯OEX超节点同台亮相,呈现超节点技术的多元化路线。这个展区布局本身揭示了一个产业共识:算力竞争的核心范式已从“单卡峰值”转向“系统效率”。

芯片厂商聚焦单卡性能,而十万卡集群需要四个维度的系统能力同时达标。

网络是第一个瓶颈。 曙光8000自研scaleFabric类IB原生RDMA高速互连技术,单子网支持11.4万卡规模,网卡端到端时延小于1微秒,交换机转发时延仅260纳秒。无需光互连即可实现十万卡超高速稳定互连——这不仅降低了成本,更提升了系统可靠性。

存储不再是配角。 ParaStor分布式存储系统在2026年IO500榜单中夺得生产型全节点、10节点两项全球性能第一。曙光方面直言:“存储是决定算力效能释放的关键因素”。算力再强,数据读不进来、写不出去,一切都是空谈。

散热与供电正在从辅助系统升级为核心竞争壁垒。 十万卡集群功耗在数万kW级别,运行时负载瞬间可从几百kW跃升至数MW。曙光8000采用浸没相变液冷+高压直流供电方案,支撑单机柜MW级功率,PUE低至1.04。

调度软件是让十万卡“像一台计算机一样工作”的关键。 Gridview 7.0统一管理超算Slurm调度系统和智算K8s调度系统,实现算力资源的自动化迁移和灵活调配。这不是简单做个界面集成,而是让两套不同的调度引擎在同一资源池上协同工作——难度远大于单一类型集群管理。

东方证券分析指出,曙光8000“基于全链路国产系统,在系统架构、网络互连、访存效率、能效控制等系统工程层面实现突破”。中信证券也强调,“系统级能力将成为算力厂商下一阶段竞争的重要要素”。

| 同一套硬件干两件事,才是下一代方向

传统超算与智算中心往往建多个资源分区,各自用独立平台管理,资源割裂严重。曙光8000选择了另一条路:全精度原生一体化设计。

所谓“超智融合”,不是把超算和智算设备放在同一机房,而是同一芯片同时支撑FP64高精度科学计算和FP8低精度AI推理。曙光8000完整支持从FP64到INT8全精度,可覆盖科学计算、大模型训练、AI推理、工业仿真等多类场景。

这种设计的价值在AI4S(AI for Science)场景中尤为突出。 AI4S的应用非常碎片化——不同学科算法、精度、网络结构各异,天然需要灵活、通用的计算能力。曙光8000已经完成近千项应用优化,涵盖大模型、机器人、创新药、新材料、量子计算、气象流体等20余个领域。其中超过70个应用实现万卡规模扩展,15项达到戈登贝尔奖量级超大规模仿真标准。

更值得关注的是应用结构的变化。中科曙光高级副总裁李斌透露,曙光8000支撑的国家战略性科学工程计算任务中,已有40%采用了AI结合的方法,比例超出预期。这说明国内大型科研团队正在快速拥抱AI,而超智融合架构为这种转型提供了可用的基础设施。

“全精度”设计让算力资源池从“专用”走向“通用”——这才是下一代基础设施的底层逻辑。

| 算力运营才是下半场

曙光8000真正值得关注的价值,不只是硬件性能,而是它已经通过国家超算互联网接入全国一体化算力网,面向全国科研高校、企业及个人用户全面开放高效、普惠的算力服务。

140万+注册用户,月均访问量1130万+,累计完成作业2.4亿个——超算互联网的运营数据说明,算力正在从“实验室资源”走向“公共基础设施”。曙光8000接入后,超算互联网日均处理作业数突破45万个个。

算力的价值在于被使用,而非被建设。 曙光8000作为国家超算互联网核心节点,正通过“十万卡共创者激励计划”“智能体生态共创计划”“核心生态伙伴招募计划”,持续降低高端算力使用门槛,让高端算力变成可便捷接入的公共服务,而非锁在机房里的“奢侈品”。

| 结语

WAIC“镇馆之宝”这个称号,如果只看到“十万卡”的震撼,就错过了一半故事。

真正的里程碑是:中国第一次拥有了经过生产环境验证的、系统级优化的、可持续运营的十万卡全国产算力基础设施。 它证明了国产算力从“能用”走向“好用”,从“拼参数”走向“拼系统”,从“建得成”走向“用得好”。

新华财经记者在WAIC首日探展报道中写道:曙光8000入选镇馆之宝,“意味着大规模国产算力从‘建得成’走向‘用得好、服务广、可复制’”。这句话点出了本质——十万卡不是终点,而是国产算力“好用”的起点。

十万卡之后,下一个竞争维度不是谁先建成下一个十万卡,而是谁能把算力真正转化为千行百业的生产力。超算互联网的140万注册用户、7294款应用商品、300余项适配应用,已经在指向这个答案。

这场从“建算力”到“用算力”的转型,才刚刚开始。

声明:本文仅为信息交流之用,不构成任何投资建议,股市有风险,投资需谨慎。

相关推荐

登录即可解锁
  • 海量技术文章
  • 设计资源下载
  • 产业链客户资源
  • 写文章/发需求
立即登录