📄

Mistral Large 4 Le Chonk 发布:1.05T 多模态 MoE,押注网络安全

2026-10-07 09:19 👁 13 阅读

🏷️ 标签

https://mistral.ai

先说几个判断:

第一,Mistral Large 4 的“大”是 MoE 式的大:1.05T 总参里每次只激活 49B,约等于 4.7%。这和近期一批开放权重模型的路子一致——用稀疏激活把“体量”和“单次开销”分开。

第二,它把“网络安全”摆到了旗舰的台面上,而且给了两个很具体的分数:Cybench 93%、CyberGym-E2E 82%。但得看清楚一个前提——官方强调不少闭源前沿模型在这类测试里“因拒绝执行任务而近零分”,所以这个差距里混着“愿不愿意做”,不只是“能不能做”。

第三,它不声称自己是全球最强。第三方 Artificial Analysis 的 Intelligence Index 约 38,低于 Claude、GPT-6 和头部中国模型;Mistral 自己说的是“美欧最佳开放权重”。这话的边界,得听清楚。

第四,它是“先 API、后开源”:2026-10-06 开放公开预览,权重预计 10 月底放出,许可证还没定。也就是说,“开放权重”现在是个承诺,不是到手的东西。

下面把这些点展开说一说。

一、事件描述

Mistral 在 2026 年 10 月 6 日放出旗舰模型 Mistral Large 4(代号 Le Chonk)的公开预览(public preview),同步在 Mistral Studio 开放试用。官方把它定位为细粒度多模态 MoE 旗舰。

事项 官方已确认内容 口径说明
发布与状态 2026-10-06,public preview 官方
模型定位 Mistral 旗舰,细粒度多模态 MoE 官方
参数量 1.05T 总参 / 49B 激活 / 1.6B 视觉编码器 官方
模态与上下文 原生图像输入,1M 上下文 官方
语言 160+ 种,含全部欧盟官方语言 官方
训练 3,800 张 Grace Blackwell,自有欧洲数据中心 官方
安全基准 Cybench 93%、CyberGym-E2E 82% 官方
定价 API $1.36/$4.18,缓存 $0.14;预览折扣 $0.68/$2.09 官方
开放权重 预计 10 月底开源,许可证待定 官方
第三方指数 Intelligence Index 约 38 Artificial Analysis

表:Mistral Large 4 发布要点(依据 Mistral 官方信息与 Artificial Analysis 整理)

二、1.05T 总参、49B 激活:又一只 MoE

Mistral Large 4 是一个细粒度混合专家模型。三个数字要拆开看:总参数 1.05 万亿,每 token 激活 490 亿,另有一个 16 亿参数的视觉编码器负责处理原生图像输入。

口径 数值
总参数 1.05T(约 1.05 万亿)
每 token 激活 49B(约 490 亿)
激活占比 约 4.7%
视觉编码器 1.6B

表:Mistral Large 4 参数的几种口径(官方)

说明白点:和近期一批开放权重模型一样,Mistral 也是用稀疏激活把“模型多大”和“每次推理要算多少”分开。49B 的激活量,意味着单次推理的算力更接近一个 490 亿参数的稠密模型,而不是 1.05 万亿。这也是它敢在 1M 上下文上跑长任务、又还能谈性价比的底子。

三、原生多模态与 1M 上下文

Mistral Large 4 支持原生图像输入,不是把视觉塞进一个外接模块,而是模型本身就能吃图。配合 1M token 的上下文,意味着你可以把很长的文档、多张图、一整段对话历史一起塞进去,让它在一个窗口里完成跨模态的推理。

语言覆盖上,官方给出的范围是 160+ 种,并且特意点名“包含全部欧盟官方语言”。这看上去是顺带一提,但放在一家欧洲公司身上,就是明确的“多语言、尤其照顾欧盟”定位——和它在欧洲数据中心训练、主打“美欧最佳开放权重”是一条线的。

四、押注网络安全:分数高,但要会读

这是这次发布里最不像“常规旗舰升级”的一点。Mistral 把网络安全单列,并给出两个分数:

基准 Mistral Large 4 备注
Cybench 93% 官方
CyberGym-E2E 82% 官方
多家闭源前沿模型(同类测试) 近零分 因“拒绝执行任务”而近乎零分

表:Mistral Large 4 网络安全相关基准(官方)

这里的关键不是 93% 和 82% 本身,而是官方补的那句话:不少闭源前沿模型在这类端到端网络任务上拿了接近零分,原因是它们“拒绝执行”——安全策略让模型宁可不做,也不接这类活。换句话说,Mistral 的高分里,混着“它愿意做”的成分,而不纯粹是“它更能做”。

这层关系得讲清楚:对真要做防御、做红队、做安全工具的人来说,一个“不轻易拒绝”的模型确实更有用;但对横向比能力的人来说,这个对比被“拒答”严重干扰,不能直接读成“Mistral 比闭源前沿强”。分数要看,前提更要看。

五、在欧洲的数据中心,用 3,800 张 Grace Blackwell 训出来

官方说,Mistral Large 4 是在 Mistral 自有的欧洲数据中心里,用 3,800 张 NVIDIA Grace Blackwell 训练出来的。

这条信息有两层:一是供应链与技术底座——Grace Blackwell 是英伟达新一代机架级芯片,3,800 张属于相当重的投入;二是地缘与主权叙事——强调“欧洲数据中心”“自有”,是在呼应欧洲对 AI 主权、数据驻留的诉求。对一个把自己定位为“美欧最佳开放权重”的厂商,这种叙事不是装饰,而是目标客户(尤其受监管的行业与政府)真正在意的卖点。

六、定价:预览期打折,缓存很便宜

API 现价与预览折扣如下:

档位 输入(每百万 token) 输出(每百万 token) 缓存输入
API 现价 $1.36 $4.18 $0.14
预览折扣 $0.68 $2.09 (同现价缓存档)

表:Mistral Large 4 API 定价(官方)

把主要费率画成条形更直观:

图:Mistral Large 4 API 主要费率对比(数据来源:Mistral 官方;单位美元/百万 token;条形按真实数值线性映射)

API 现价 输入   ████                      1.36
API 现价 输出   ██████████                4.18
预览折扣 输入   ██                        0.68
预览折扣 输出   █████                     2.09

说明:条形长度按各档费率真实数值线性缩放。输出价约为输入的 3 倍,符合前沿模型“输出贵”的普遍规律;缓存输入 $0.14 远低于常规输入价,长上下文复用场景能明显降本。预览折扣约为现价的一半,属推广期安排,后续是否调整看官方。

七、Intelligence Index 约 38:它没说自己全球最强

据第三方 Artificial Analysis 的 Intelligence Index,Mistral Large 4 约 38,低于 Claude、GPT-6 与头部中国模型。这个数字是第三方基准口径,不是 Mistral 自述。

也正因如此,Mistral 给自己定的位是“美欧最佳开放权重”(best open-weight in the US and EU),而不是“全球最强”。这句话的边界很清楚:它要争的是“开放权重”赛道里、在美欧语境下的头部,而不是和闭源前沿比绝对智能上限。对读者来说,拿它和 GPT-6、Claude 比“谁更聪明”会跑偏;拿它和同属开放权重的模型比“在美欧能不能合规部署、性价比如何”,才是它的主战场。

八、结语

Mistral Large 4(代号 Le Chonk)是 Mistral 在 2026 年 10 月 6 日放出的旗舰公开预览:细粒度多模态 MoE,1.05T 总参、49B 激活、1.6B 视觉编码器,原生图像输入、1M 上下文、160+ 语言,在自有欧洲数据中心用 3,800 张 Grace Blackwell 训练;主打网络安全,给出 Cybench 93%、CyberGym-E2E 82%,并强调闭源前沿因“拒答”而近零分;API 现价 $1.36/$4.18、缓存 $0.14、预览折扣 $0.68/$2.09;Intelligence Index 约 38(第三方),自称为“美欧最佳开放权重”;目前仅 API,权重预计 10 月底开源,许可证待定。

值得冷静看待的有几处:一是“1.05T”是 MoE 总参,单次激活仅 49B,看效率别看体量;二是网络安全高分混着“愿意做”的成分,不能直接读成能力碾压闭源;三是“开放权重”现在只是承诺,权重与许可证都要等 10 月底;四是 Intelligence Index 约 38 低于头部闭源与部分中国模型,它的主战场是“美欧合规开放的旗舰”,不是全球智能榜首。对使用者来说,真正要等的,是 10 月底权重落地、许可证敲定之后,第三方能否独立复现这些分数与安全表现——那比预览当天的通稿更说明问题。