Mistral开放一万亿参数Large 4预览版
Mistral上线一万亿参数多模态模型Large 4公开预览,并承诺月底前发布权重,主打编程、智能体与网络安全。
Mistral开放了Mistral Large 4公开预览。这是一款拥有一万亿参数、49 billion激活参数的混合专家多模态模型,目前可通过Mistral Studio使用;公司表示,模型权重将在10月底前发布,而不是随预览版同步开放。
Mistral将Large 4定位为覆盖编程、工具调用型智能体、多模态理解和专业知识工作的通用模型。公司披露的成绩包括DeepSWE 1.1达到61.7%、Terminal-Bench 4达到28.3%,以及AutomationBench达到59.9%。后者测试模型在Gmail、表格、Slack和Salesforce等应用中的多步工作流表现。网络安全方面,Mistral称模型在Cybench上完成率为93%,在一个漏洞复现与修补测试中达到82%。
网络安全是此次发布的核心卖点。Mistral认为,开放部署能让防守方获得强大的安全能力,同时避免部分闭源模型因服务商拒答而无法执行合法漏洞研究。公司称,Large 4使用欧洲数据中心的3800张NVIDIA Grace Blackwell GPU从头训练,并支持160多种语言,包括欧盟全部官方语言。
不过,目前最关键的权重尚未公开,以上结果也主要来自公司披露。在权重落地前,开发者能获得的是API访问和Mistral的评测叙事,还不能检查模型或自行部署。
为什么重要:欧洲正在用模型规模、多语言能力、主权基础设施和开放权重承诺,提出一套不同于美国闭源路线的旗舰模型方案。月底权重发布后的真实可用性,才会决定这是否能形成持久的生态优势。