• 正文
  • 相关推荐
申请入驻 产业图谱

被誉为欧洲全村人的希望,Mistral Large 4震撼发布,敢硬刚DeepSeek?

12小时前
71
加入交流群
扫码加入
获取工程师必备礼包
参与热点资讯讨论

OMG,兄弟们我刚刚看到了一个劲爆的消息,给大家截图看看。

Mistral Large 4 ,又叫 Le Chonk(中文释义:Big 块头)啥啥的,反正我是不会念。

就这玩意发布了。

估计大家寻思,这又是谁家模型啊,没人认领了?还真不是,因为这个 Mistral Large 4 ,被誉为欧洲的希望。。。。。。


众所周知,欧洲在大模型训练的基础上可谓是慢的一批。

这两年大模型打的太激烈了,基本上属于狂飙状态。老美有 OpenAI、Anthropic、我国有 DeepSeek、Qwen、GLM、Kimi 。

反观欧洲呢?在底层前沿模型上几乎处于全面掉队的状态。

图源:斯坦福 2026 AI Index,第 17 页,数据来自 Epoch AI。

甚至有网友调侃,“美国做技术,中国做开源,欧洲开罚单”。

但欧洲的很多企业和政府内心里其实慌的一批。因为自家的银行、能源、国防军工、核心法务系统,天天都在用美国的云端 API,要么就是私有化部署中国的开源底座。欧洲人天天倡导的 AI 主权,喊得嗓子都哑了,但手里一个能打的都没有。

于是欧洲全村的希望,基本就押在了法国这帮从 DeepMind 和 Meta 跑出来的Mistral AI 身上。

而这次,Mistral 是真掏出看家本领了。

总参数高达 1.05 万亿,激活参数 49B 的原生多模态 MoE 架构。

好家伙,看起来挺吓人,欧洲的希望也上到 1T 级别了。


下面来看一下完整测评评分

DeepSWE 1.1,写代码层面

ML4 的精确成绩是 61.7%,图里四舍五入写成了 62%。GLM-5.3 约 61%,Kimi K3 是 68%。法国队终于能坐到这张桌子上了。

Terminal-Bench 4,终端干活层面

ML4 是 28.3%,高于图里的 Kimi K3(21%)和 DeepSeek V4 Pro 0813(10%),但 GLM-5.3 做到了 40%。这个成绩说明它已经能做一部分复杂终端任务了,也能看出距离稳定交付还有空间。

网络安全层面

AA Cyber Index 测的是模型发现、验证和修复软件安全问题的能力。ML4 拿到 50 分,和 GLM-5.3-Flash 持平,高于图里的 Kimi K3、DeepSeek V4.1 Flash(均为 41)。

办公自动化,AutomationBench。

ML4 是 59.9%,Mistral Medium 3.5 只有 6.3%。从自家模型对比来说,这个进步相当大。并且它超过了 Kimi K3 的 58.3% 和 DeepSeek V4 Pro 0813 的 56.7%,GLM-5.3 则是 62.2%。

金融任务,Finance Agent v2。

ML4 拿到 54.7%,上一代 Medium 3.5 是 32.1%。图里的 GPT-6 Astra 为 53.5%,GLM-5.3 为 55.8%。这类任务会涉及查找资料、处理财务数据、多步分析。ML4 已经进入图中这批模型的第一梯队,但和相邻模型的分差不大。

法律任务。ML4 是 15.8%,Kimi K3 是 12.9%,GLM-5.3 是 8.3%,GPT-6 Astra 是 5.4%。在图中这组对比里,ML4 领先。

Dense 200 视觉定位。

这项要求模型从密集画面里找到指定对象,并给出位置框。ML4 是 42.0%,图里的 GPT-6 Astra 是 41.5%,Kimi K3 是 28.9%。

我看完这七项的判断是,这次欧洲希望队好像不用坐桌角那桌了。以至于 Mistral AI官方也是玩了个有意思的,大胖猫一跃跑到了 DeepSeek V4.1 Flash 的水平。

ML4 的综合智能指数是 38,DeepSeek V4.1 Flash(max)是 39,GPT-6 Luna(max)也是 38。


下面来看看价格。

目前官方给出的 Mistral Studio API 预览定价是:

• 输入价格(Input Tokens):$1.36 / 1M tokens(每百万 Token 约 1.36 美元,折合人民币不到 10 块钱)

• 输出价格(Output Tokens):$4.18 / 1M tokens(每百万 Token 约 4.18 美元,折合人民币大概 30 块钱)

价格对我们来说没啥优势,我们的 Flash 模型性价比来说依旧是一流。

不过欧洲企业愿意多付钱,往往还想换来对模型、部署位置和运行方式的更多控制,这就是他们的事儿了。


想试试这只大胖猫的话,现在已经可以上手了。

打开 Mistral Studio 的 Playground,注册并登录。在模型菜单里选择 Mistral Large 4就可以了。

想接进其他 Agent ,就走 API。

不过欧洲的希望真是好家伙,不升级套餐连 API key 都不让创建,体验一下都不行,果然是人权拉满了。

于是只能拿官方的图了。

在 Studio 控制台打开 API Keys,点击 Create new key,给 Key 取个名字并创建,然后复制保存。


作为 Mistral AI 的 CodeGen lead 也是贼拉激动。

我能想象到这哥们此刻是不是也仿佛看到原子弹爆炸似的瘫坐了。

我从 Mistral 团队成员的帖子中感受到了深深的骄傲。

除了团队自己嗨,某知名社交平台的科技圈大 V 和开源社区也彻底炸了锅。

TestingCatalog 看完法律榜单,直接来了一句:“Looks like it is a LEGAL BEAST!”

甚至做本地部署和模型优化的 Unsloth,直接喊出:“Open-source is so back! Go Mistral!” 他们还说,已经等不及给这只大胖猫做量化版本了。


不得不说,Mistral Large 4 的横空出世,确实让欧洲把掉在地上的面子给捡起来吹了吹。

但是细想了好像没点锤子用。。。价格比我们 Flash 旗舰贵,但能力打不过我们 Flash 模型,凭啥用它?

它的定位:欧洲挽尊模型了属于是,我估计后面这个模型只有欧洲开罚单的哥们儿自己用了。

没办法,为了人权,硬着头皮也得用。

我是 cxuan,我们下期再见。

相关推荐

cxuan 写的文章还不错。会分享计算机底层、计算机网络、操作系统,Java基础、框架、源码等文章。