传统服务器AI推理长期采用“CPU通用计算+PCIe独立AI加速卡”的分离架构,在大模型时代暴露出三大结构性缺陷。首先是数据搬运瓶颈,数据在CPU内存与加速卡显存间反复拷贝,延迟随调用频率线性增长,形成系统性能的隐形天花板。其次是部署成本高企,额外采购独立推理卡、增加供电与散热开销,使得整机部署成本大幅上升,大量AI项目因总拥有成本过高而无法落地。第三是运维复杂度倍增,多卡集群带来故障点增多、兼容性适配、驱动维护等负担,机柜密度受限,实际算力利用率普遍低于50%,部分场景甚至不足40%。8月13日,在第五届滴水湖中国RISC-V产业论坛上,蓝芯算力(深圳)科技有限公司生态营销负责人许庆伟正式发布了全球首款量产型RISC-V+AI智通融合服务器CPU——LX500。该芯片已实现规模化部署,并与联想等头部企业达成量产合作,标志着RISC-V高性能芯片正式迈入商业化深水区。据许庆伟介绍,LX500采用原生融合架构,集成48个RISC-V核心,并内置75 TOPS INT8算力的AI加速单元。其最大突破在于统一内存管理,支持DDR5内存规格,最高可扩展至2TB,彻底解决传统方案中内存与显存隔离带来的性能损耗。该设计尤其适配大模型推理场景,例如Kimi和Qwen等主流模型已直接在LX500内置AI Core上高效运行,避免了因单卡显存不足而被迫堆叠多张加速卡的成本问题。针对服务器级应用场景,LX500不仅关注峰值性能,更强化了RAS特性(可靠性、可用性、可维护性),全面兼容RISC-V服务器标准,满足工业控制、大型集群等严苛环境下的7×24小时稳定运行要求。基于LX500的“智通融合”架构,蓝芯算力推出了智能体一体机产品,将单芯片的双重算力与私有化部署的便捷性融为一体。该一体机无需额外配置独立推理卡,单颗芯片即可并行处理通用计算与高性能AI推理,实现“一颗芯片、双重算力”,极大简化企业部署流程,真正做到开箱即用。同时,它精准解决了中小企业预算有限、缺乏专业运维团队及数据隐私敏感等难题,提供低成本、易维护、高安全的本地化方案,完美平衡算力性能与数据合规性,加速AI在国企、央企及特殊行业的规模化落地。在技术栈层面,LX500底层涵盖芯片、开发板、服务器及整机柜硬件;中间层包含编译器、AI基础架构及主流AI框架适配;上层则面向工业、金融、教育等行业的差异化AI需求,提供灵活的应用支撑。2026年7月,蓝芯算力与联想集团联合在合肥联宝科技完成全球首台RISC-V量产服务器的开发与调试,该机型已归入联想WR5219 G5产品序列,并在WAIC 2026正式亮相,目前处于已量产、已售卖状态。许庆伟表示,当前LX500已在多个关键场景实现规模化部署。在运营商领域,已完成适配与小规模部署,应用于云平台及虚拟化场景;在央国企数据中心,满足基础设施及安全相关需求,已开放基于LX500的云场景在线测试;高校科研方面,推出了安全增强型芯片及专用仿真验证平台;工业领域与多家工业级厂商合作,落地智能巡检、AI质检主机等应用;金融行业则支持智能风控、量化交易及国产替代需求。在模型推理方面,LX500已成功运行Kimi、千问等万亿参数级别模型,支持128KB长上下文推理,覆盖绝大多数无需额外昂贵加速卡的AI应用场景。许庆伟强调,从芯片架构创新到一体机产品落地,再到多行业规模化部署,蓝芯算力LX500正以RISC-V+AI的融合路径,重新定义AI时代的算力供给方式,为国产高性能芯片的商业化探索提供了坚实范本。
291