法国 AI 初创公司 Mistral 于周二推出 Mistral Large 4 模型,声称其性能可以超越其他美国和欧盟开放权重模型。

Mistral Large 4 的昵称是“le Chonk”,能够处理代码编写、图像和文本处理,以及使用软件完成更复杂的工作等任务。

Mistral 的公开预览版数据表显示,该模型的总参数量超过 1 万亿。

Model 4 性能

Mistral 表示,Large 4 的性能与市场上最强的开放模型相当或更好。

在测试模型处理复杂法律任务能力的“Harvey's Legal Agent”基准测试中,Large 4 的得分比排名第二的模型 Kimi K3 高出近 3%,比 OpenAI 的 GPT-6 Astra 高出超过 10%。

Mistral 4 Harvey's Legal Agent 基准测试
Mistral 4 Harvey's Legal Agent 基准测试。来源:Mistral

ML4 在编码和企业工作流方面也能与其他主要模型竞争。

其网络安全基准测试得分同样十分突出。Large 4 在 Artificial Analysis Cyber Index 上获得 50 分。该指数用于衡量 AI 发现软件安全漏洞并修复这些漏洞的能力。它与另一款顶尖模型 GLM-5.3-Flash 并列,排名领先于 DeepSeek-V4.1-Flash 和 Kimi K3。

AA Cyber Index 基准测试
AA Cyber Index 基准测试。来源:Mistral

该公司将 Model 4 定位为其推动 AI 主权战略的一部分,并表示该模型“旨在让客户掌控自己的 AI”。

Mistral 预计将在十月底前提供模型权重,届时用户将能够在自己的基础设施上部署 Large 4。