Mistral加速推进中国开放权重AI,网络安全能力成为卖点
Mistral 已推出其万亿参数规模开源权重模型 Mistral Large 4(ML4)的公开预览版,并称其为在中国境外构建的最强大的同类模型。
网络安全是该代号为“Le Chonk”的模型的主要卖点。该模型可通过 Mistral 的 API 使用。公司在公告中表示,在与开发者、安全公司和政府机构进行为期三周的测试后,将于 10 月 27 日左右发布可下载的模型权重。
一周前,在 9 月 29,Anthropic 分享了来自 其研究, 警告称智谱 AI 的开源权重模型 GLM-5.3(在海外被称为 Z.ai)能够自主构建可用的网络漏洞利用工具。它还指出,该模型可能附带足够薄弱的安全防护,从而在大多数情况下被绕过。
“开源权重模型的领先者”以及基准测试结果
联合创始人兼首席科学家Guillaume Lample表示:“ML4处于开放权重模型的前沿。”
该模型于10月6日(星期二)发布,已在DeepSWE v1.1(一种智能体编码测试)中进行了初步测试,Large 4在该测试中的得分为62%,仅比GLM-5.3高出1%。
为什么Anthropic对GLM-5.3的警告如此重要?
Anthropic的研究有助于Mistral对其产品进行定位。
在9月17日由Anthropic引用的一份评估报告中,美国政府的AI标准与创新中心将GLM-5.3称为“迄今为止发布的网络能力最强的开放权重模型”,其落后于美国前沿水平约四个月。
Anthropic自身的“前沿红队”发现,该模型能够在轻度监督工作下不到一天的时间内,将先前未知的浏览器漏洞串联起来,形成有效的攻击利用。
问题在于安全防护措施。该公司指出,在模拟测试中,攻击者使用简单技术绕过GLM-5.3内置保护的成功率“在64%到100%之间”。Anthropic表示,同样的攻击针对经过安全加固的Claude模型则未能成功。
开放权重模型与美国实验室的封闭模型
美国领先的AI实验室大多未将其最强大的模型向公众开放。Anthropic的Claude Mythos Preview就是一个例子,这是其最强大的网络安全模型,并未面向公众发布。
Anthropic采取的做法是通过Project Glasswing项目将模型提供给约40家经过审核的机构,因为其认为该模型过于危险,不宜随意分发。
OpenAI在四月也采取了类似措施,在其“网络安全可信访问”(Trusted Access for Cyber)项目中,对GPT-5.4-Cyber变体实施了分级身份验证。同年九月,该公司表示其 Astra模型 在其准备度框架中达到了“关键”网络安全门槛。
Mistral则采取了与美国同行不同的路径。它不对模型进行限制,理由是安全团队需要每天扫描自己的系统。这些团队还发现,封闭模型在此类使用量下往往成本过高,并且在某些情况下会直接拒绝双重用途请求。
“网络防御能力将使企业和政府能够抵御那些通过越狱封闭模型来实施网络攻击的黑客”,Lample表示。预览阶段的开发者、网络安全公司和政府机构将获得一个比公共API限制更少的版本。
以€3亿融资为支撑的主权战略
9月,Mistral宣布以超过€210亿的估值完成了€30亿(约35亿美元)的融资。Large 4是该公司自该公告以来发布的首个模型。
该模型在两个月内基于约4,000块英伟达Grace Blackwell GPU,在Mistral的欧洲数据中心从头开始训练而成。
最聪明的加密领域人士已经在阅读我们的通讯。想加入吗?加入他们。







