OMG,兄弟们我刚刚看到了一个劲爆的消息,给大家截图看看。
Mistral Large 4 ,又叫 Le Chonk(中文释义:Big 块头)啥啥的,反正我是不会念。
就这玩意发布了。
估计大家寻思,这又是谁家模型啊,没人认领了?还真不是,因为这个 Mistral Large 4 ,被誉为欧洲的希望。。。。。。
众所周知,欧洲在大模型训练的基础上可谓是慢的一批。
这两年大模型打的太激烈了,基本上属于狂飙状态。老美有 OpenAI、Anthropic、我国有 DeepSeek、Qwen、GLM、Kimi 。
反观欧洲呢?在底层前沿模型上几乎处于全面掉队的状态。
图源:斯坦福 2026 AI Index,第 17 页,数据来自 Epoch AI。
甚至有网友调侃,“美国做技术,中国做开源,欧洲开罚单”。
但欧洲的很多企业和政府内心里其实慌的一批。因为自家的银行、能源、国防军工、核心法务系统,天天都在用美国的云端 API,要么就是私有化部署中国的开源底座。欧洲人天天倡导的 AI 主权,喊得嗓子都哑了,但手里一个能打的都没有。
于是欧洲全村的希望,基本就押在了法国这帮从 DeepMind 和 Meta 跑出来的Mistral AI 身上。
而这次,Mistral 是真掏出看家本领了。
总参数高达 1.05 万亿,激活参数 49B 的原生多模态 MoE 架构。
好家伙,看起来挺吓人,欧洲的希望也上到 1T 级别了。
下面来看一下完整测评评分
DeepSWE 1.1,写代码层面
ML4 的精确成绩是 61.7%,图里四舍五入写成了 62%。GLM-5.3 约 61%,Kimi K3 是 68%。法国队终于能坐到这张桌子上了。
Terminal-Bench 4,终端干活层面
ML4 是 28.3%,高于图里的 Kimi K3(21%)和 DeepSeek V4 Pro 0813(10%),但 GLM-5.3 做到了 40%。这个成绩说明它已经能做一部分复杂终端任务了,也能看出距离稳定交付还有空间。
网络安全层面
AA Cyber Index 测的是模型发现、验证和修复软件安全问题的能力。ML4 拿到 50 分,和 GLM-5.3-Flash 持平,高于图里的 Kimi K3、DeepSeek V4.1 Flash(均为 41)。
办公自动化,AutomationBench。
ML4 是 59.9%,Mistral Medium 3.5 只有 6.3%。从自家模型对比来说,这个进步相当大。并且它超过了 Kimi K3 的 58.3% 和 DeepSeek V4 Pro 0813 的 56.7%,GLM-5.3 则是 62.2%。
金融任务,Finance Agent v2。
ML4 拿到 54.7%,上一代 Medium 3.5 是 32.1%。图里的 GPT-6 Astra 为 53.5%,GLM-5.3 为 55.8%。这类任务会涉及查找资料、处理财务数据、多步分析。ML4 已经进入图中这批模型的第一梯队,但和相邻模型的分差不大。
法律任务。ML4 是 15.8%,Kimi K3 是 12.9%,GLM-5.3 是 8.3%,GPT-6 Astra 是 5.4%。在图中这组对比里,ML4 领先。
Dense 200 视觉定位。
这项要求模型从密集画面里找到指定对象,并给出位置框。ML4 是 42.0%,图里的 GPT-6 Astra 是 41.5%,Kimi K3 是 28.9%。
我看完这七项的判断是,这次欧洲希望队好像不用坐桌角那桌了。以至于 Mistral AI官方也是玩了个有意思的,大胖猫一跃跑到了 DeepSeek V4.1 Flash 的水平。
ML4 的综合智能指数是 38,DeepSeek V4.1 Flash(max)是 39,GPT-6 Luna(max)也是 38。
下面来看看价格。
目前官方给出的 Mistral Studio API 预览定价是:
• 输入价格(Input Tokens):$1.36 / 1M tokens(每百万 Token 约 1.36 美元,折合人民币不到 10 块钱)
• 输出价格(Output Tokens):$4.18 / 1M tokens(每百万 Token 约 4.18 美元,折合人民币大概 30 块钱)
价格对我们来说没啥优势,我们的 Flash 模型性价比来说依旧是一流。
不过欧洲企业愿意多付钱,往往还想换来对模型、部署位置和运行方式的更多控制,这就是他们的事儿了。
想试试这只大胖猫的话,现在已经可以上手了。
打开 Mistral Studio 的 Playground,注册并登录。在模型菜单里选择 Mistral Large 4就可以了。
想接进其他 Agent ,就走 API。
不过欧洲的希望真是好家伙,不升级套餐连 API key 都不让创建,体验一下都不行,果然是人权拉满了。
于是只能拿官方的图了。
在 Studio 控制台打开 API Keys,点击 Create new key,给 Key 取个名字并创建,然后复制保存。
作为 Mistral AI 的 CodeGen lead 也是贼拉激动。
我能想象到这哥们此刻是不是也仿佛看到原子弹爆炸似的瘫坐了。
我从 Mistral 团队成员的帖子中感受到了深深的骄傲。
除了团队自己嗨,某知名社交平台的科技圈大 V 和开源社区也彻底炸了锅。
TestingCatalog 看完法律榜单,直接来了一句:“Looks like it is a LEGAL BEAST!”
甚至做本地部署和模型优化的 Unsloth,直接喊出:“Open-source is so back! Go Mistral!” 他们还说,已经等不及给这只大胖猫做量化版本了。
不得不说,Mistral Large 4 的横空出世,确实让欧洲把掉在地上的面子给捡起来吹了吹。
但是细想了好像没点锤子用。。。价格比我们 Flash 旗舰贵,但能力打不过我们 Flash 模型,凭啥用它?
它的定位:欧洲挽尊模型了属于是,我估计后面这个模型只有欧洲开罚单的哥们儿自己用了。
没办法,为了人权,硬着头皮也得用。
我是 cxuan,我们下期再见。
71