AI算力的供给方式,正处在一个被重新定义的拐点。过去十年,CPU搭配独立加速卡的分离式架构几乎是数据中心推理的唯一解。但数据在内存与显存间的反复搬运、部署时叠加的供电与散热成本、运维中故障点的指数级增长,让这种架构在AI大模型时代显露出难以掩盖的疲态。算力利用率不足40%,并非算力不够,而是“墙”太多——内存墙、传输墙、成本墙。

图 | 算力利用率不足40%的真相;来源:蓝芯算力
在今日举办的第五届滴水湖中国RISC-V产业论坛上,蓝芯算力生态营销负责人许庆伟带来了一颗已量产的芯片——LX500。

图 | 蓝芯算力生态营销负责人许庆伟
许庆伟认为,这颗芯片的特别之处,不在于单纯堆叠48核或75TOPS的INT8算力,而在于它用“智通融合”的异构设计,将通用计算与AI推理原生压缩到同一颗芯片上。统一内存管理、支持DDR5与CXL 2.0扩展至2TB寻址空间,意味着Kimi和Qwen这类大参数模型不再需要跨卡搬运数据,单芯片即可承载千亿级推理负载。更重要的是,它把RISC-V架构长期被质疑的稳定性和安全性短板,用服务器级的RAS特性、国密算法支持和DVFS功耗管理补全了。
许庆伟表示,LX500在架构上做了不少减法,目的是在实际部署中转化成效率的加法。所以我们看到,基于LX500的智能体一体机,直接绕过了独立推理卡的采购与适配环节,实现了“开箱即用”。这对预算有限、运维力量薄弱却又面临数据隐私压力的企业而言,是一条现实可行的AI落地路径。

图 | LX500纳入联想问天WR5219 G5产品序列,正式对外售卖;来源:蓝芯算力
而在产业维度,LX500的商业化进度已经跳出了实验室或样片阶段——2026年7月,它与联想联合在合肥联宝工厂下线了全球首台RISC-V量产服务器,并被纳入联想问天WR5219 G5产品序列,正式对外售卖。运营商的核心业务适配、央国企数据中心的托管部署、金融行业的智能风控与量化交易场景,以及高校科研的安全仿真平台,都已有了它的身影。
来源: 与非网,作者: 夏珍,原文链接: https://www.eefocus.com/article/2068312.html
615