AI导航

Mistral 发布 Large 4 公开预览:万亿参数多模态模型月底开放权重

AI资讯
3 min read
0 次阅读

Mistral Large 4 是 Mistral 在 2026 年 10 月 6 日通过官方博客发布的公开预览模型:总参数 1 万亿、每次激活约 490 亿参数,原生处理文本与图像,预览接口当天已在 Mistral Studio 上线,完整权重计划在本月底开放。关注开放权重和私有部署的团队,现在可以先用预览接口验证效果,正式选型则要等权重、许可与架构细节一起落地。

规格之外,它卖的是欧洲自建算力

Large 4 从零训练,使用了 3800 张 NVIDIA Grace Blackwell GPU,跑在 Mistral 位于欧洲的自有数据中心里,预览服务也由同一套基础设施提供。训练数据覆盖 160 多种语言,包括欧盟全部官方语言。Mistral 把这一点和部署方式绑在一起讲:模型将提供欧洲区域的端到端自营部署,组织也可以在权重开放后自行部署,不必把关键业务完全交给别家的云端接口。对受数据驻留和供应商锁定困扰的欧洲企业,这是这款模型最实际的卖点。

编程、智能体和看图,三条线都有具体分数

按 Mistral 公布的成绩,Large 4 在软件工程基准 DeepSWE v1.1 上得 61.7%,在覆盖 Gmail、表格、Slack 等应用的 657 个业务流程组成的 AutomationBench 上得 59.9%,两项都排在若干同级开放模型之前。视觉方面它强调定位能力:在 Dense 200 视觉定位测试上得 42%,略高于其对比的 GPT-6 Astra 的 41%,演示包括在卫星大图里找目标、核对工程图纸和从 PDF 里取证。这些分数均为厂商自报,独立复测还没跟上,适合用来排试用优先级,不适合直接当采购结论。

网络安全能力强,同时也是权重开放前先红队的原因

安全类成绩是这篇发布里最突出的部分:它在 Cybench 的 40 道安全竞赛题中解出 93%,在一项复现真实开源漏洞并给出补丁的测试中得 82%,为受测模型最高。Mistral 同时说明,权重开放前这段时间会让网络安全机构、经过审查的合作伙伴和相关部门以降低限制的版本做真实场景红队测试;面向恶意网络请求的拒答率和提示注入抵抗成绩也一并公布。这意味着安全团队能较早拿到可自部署的强模型做防御研究,但开放权重一旦放出,能力边界由部署方自己的策略决定,这正是它先做红队、后放权重的顺序逻辑。

现在试还是等月底,看你要验证什么

只需要验证问答、编程和多模态效果的团队,现在用预览接口就够了,成本最低。打算私有部署的团队则要等月底:权重文件、许可条款、推理框架适配和显存需求目前都未公布,1 万亿总参数意味着即便激活参数只有 490 亿,部署门槛也不会低。Mistral 还预告权重发布时将补上架构与后训练方法的完整说明,并以 Large 4 为底座推出一批专用模型;RL 训练按官方说法仍在继续、成绩还在涨。把试用结论留到权重版复测后再定版,是更稳妥的节奏。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。