国产Coding争霸赛:MiniMax爆冷登顶,DeepSeek性价比称王
本次评测展示了五款国产模型在真实工程任务中的表现,包括优惠券系统和Bug诊断修复两个任务。MiniMax M3表现出色,特别是在Bug诊断和修复方面,获得最高分;DeepSeek V4 Pro在架构设计上表现出色,但在代码实现上存在低级错误;Kimi K2.6和Qwen 3.7 Max在多个方面表现出稳定性和规范性;GLM 5.1在安全性方面存在问题。综合来看,MiniMax M3在综合评分上排名第一,DeepSeek V4 Pro在性价比上最具优势。