Mistral Large 4 是 Mistral 在 2026 年 10 月 6 日通过官方博客发布的公开预览模型:总参数 1 万亿、每次激活约 490 亿参数,原生处理文本与图像,预览接口当天已在 Mistral Studio 上线,完整权重计划在本月底开放。关注开放权重和私有部署的团队,现在可以先用预览接口验证效果,正式选型则要等权重、许可与架构细节一起落地。
规格之外,它卖的是欧洲自建算力
Large 4 从零训练,使用了 3800 张 NVIDIA Grace Blackwell GPU,跑在 Mistral 位于欧洲的自有数据中心里,预览服务也由同一套基础设施提供。训练数据覆盖 160 多种语言,包括欧盟全部官方语言。Mistral 把这一点和部署方式绑在一起讲:模型将提供欧洲区域的端到端自营部署,组织也可以在权重开放后自行部署,不必把关键业务完全交给别家的云端接口。对受数据驻留和供应商锁定困扰的欧洲企业,这是这款模型最实际的卖点。
编程、智能体和看图,三条线都有具体分数
按 Mistral 公布的成绩,Large 4 在软件工程基准 DeepSWE v1.1 上得 61.7%,在覆盖 Gmail、表格、Slack 等应用的 657 个业务流程组成的 AutomationBench 上得 59.9%,两项都排在若干同级开放模型之前。视觉方面它强调定位能力:在 Dense 200 视觉定位测试上得 42%,略高于其对比的 GPT-6 Astra 的 41%,演示包括在卫星大图里找目标、核对工程图纸和从 PDF 里取证。这些分数均为厂商自报,独立复测还没跟上,适合用来排试用优先级,不适合直接当采购结论。
网络安全能力强,同时也是权重开放前先红队的原因
安全类成绩是这篇发布里最突出的部分:它在 Cybench 的 40 道安全竞赛题中解出 93%,在一项复现真实开源漏洞并给出补丁的测试中得 82%,为受测模型最高。Mistral 同时说明,权重开放前这段时间会让网络安全机构、经过审查的合作伙伴和相关部门以降低限制的版本做真实场景红队测试;面向恶意网络请求的拒答率和提示注入抵抗成绩也一并公布。这意味着安全团队能较早拿到可自部署的强模型做防御研究,但开放权重一旦放出,能力边界由部署方自己的策略决定,这正是它先做红队、后放权重的顺序逻辑。
现在试还是等月底,看你要验证什么
只需要验证问答、编程和多模态效果的团队,现在用预览接口就够了,成本最低。打算私有部署的团队则要等月底:权重文件、许可条款、推理框架适配和显存需求目前都未公布,1 万亿总参数意味着即便激活参数只有 490 亿,部署门槛也不会低。Mistral 还预告权重发布时将补上架构与后训练方法的完整说明,并以 Large 4 为底座推出一批专用模型;RL 训练按官方说法仍在继续、成绩还在涨。把试用结论留到权重版复测后再定版,是更稳妥的节奏。