欧洲万亿参数模型登场:Mistral Large 4公开预览,月底开放权重

AI资讯3天前发布 EdgeClaw
1 00

当地时间10月6日,法国AI公司Mistral AI正式推出Mistral Large 4(简称ML4,内部代号le Chonk)的公开预览版。即日起用户可在Mistral Studio体验预览API,模型权重则将于本月底开放下载。

1万亿参数只激活490亿

ML4是一款原生多模态的稀疏MoE模型:总参数1.05万亿,每个Token仅激活490亿参数,另配16亿参数的视觉编码器,上下文窗口高达100万Token。约5%的激活率意味着,推理成本接近一个490亿参数的稠密模型,但知识容量远超普通小模型。作为Mistral旗舰序列的第四代,ML4的定位很明确:用稀疏MoE把万亿参数的成本压下来,同时守住欧洲自主可控这条底线。

等距3D半透明立方体集群与点亮节点,呈现万亿参数模型稀疏激活的架构特点

模型还内置了混合推理能力,提供关闭思考与完整思考两档模式:前者响应更快,适合高频调用;后者会输出完整推理过程,适合复杂任务。Mistral称,ML4实测表现足以媲美全球顶尖开源模型,更大幅领先于欧美此前发布的所有开放权重模型。

性能与定价

从公开数据看,ML4在DeepSWE v1.1软件工程评测中拿到61.7%,网络安全基准Cybench达到93%,AutomationBench智能体任务59.9%,均在开源阵营中名列前茅。在Artificial Analysis综合指数上,它拿到38分,与552B参数的DeepSeek 4.1 Flash同处第一梯队,并大幅拉开与上一代模型的差距。

而在网络安全、金融、法律等企业级任务中,它在开源模型里达到SOTA,部分领域如视觉定位甚至超越闭源前沿模型。定价方面,ML4每百万Token输入1.36美元、输出4.18美元,缓存输入仅0.14美元,约为多数同档闭源旗舰的一半。

欧洲主权AI的算力底座

欧洲地图轮廓与数据中心剪影相连,象征Mistral欧洲自主算力底座与主权AI

ML4的训练完全在Mistral位于欧洲的自建数据中心完成,使用了3800块英伟达Grace Blackwell GPU,从零开始训练,不依赖任何第三方云服务商。训练语料覆盖160多种自然语言,囊括全部欧盟官方语言,严格遵循欧盟法规。

这背后是欧洲对”主权AI”的执念。对金融、医疗、政府等机构来说,核心数据不出欧洲是硬需求,而把数据长期交给美国云厂商并不理想。开放权重加本地部署,让企业可以自托管、微调模型,构建专属AI系统,这正是Mistral与OpenAI、Anthropic闭源路线最大的不同。

Mistral今年完成30亿欧元D轮融资,被称为欧洲科技公司史上最大单笔融资。与德国Aleph Alpha被Cohere收购的曲折不同,Mistral选择独立扩张,并把开放权重、欧洲本地部署作为核心卖点。

目前ML4正与网络安全机构、政府监管部门联合开展红队测试,该测试版本放宽了内容安全审查策略,并强化了攻防技术能力,相关合作方会拿到专项测试权限。需要提醒的是,眼下所有性能数据均来自Mistral官方披露,第三方独立评测仍需时间验证。

对开发者来说,ML4的预览API已经可以上手体验,月底权重开放后,企业能否在自有数据中心跑起这台万亿参数模型,将是检验”欧洲开源路线”成色的试金石。

© 版权声明

相关文章