当前位置: 首页 » 资讯 » 科技头条 » 正文

Mistral AI推出Mistral 3模型:3B到675B,Apache 2.0开源

IP属地 中国·北京 IT之家 时间:2025-12-03 10:30:16

IT之家 12 月 3 日消息,法国人工智能初创企业 Mistral AI 当地时间 2 日宣布推出其新一代 Mistral 3 系列模型,包括其采用稀疏架构的首款混合专家模型 Mistral Large 和三款小型密集模型。

Mistral Large 总参数量为 675B,活跃参数规模为 41B;Minstral 3“三兄弟”的参数规模分别为 14B、8B、3B。这些模型及衍生版本均以 Apache 2.0 许可证开源

Mistral AI 表示,使用 3000 块英伟达 H200 GPU 从头训练的 Mistral Large 3 是全球顶尖的开放权重模型之一



在经过后训练后,该模型在通用提示方面与市场上最佳的指令微调开放权重模型达到了同等水平,同时在多语言对话方面展示了图像理解和行业顶尖性能。Mistral Large 3 在 LMArena 排行榜的 OSS 非推理模型类别中位列第二,OSS 总榜第六。


对于参数较小的 Minstral 3,Mistral AI 称其实现了所有 OSS 模型中最佳的性价比,这些模型的指令变体在性能上与同类模型相当或更优,同时生成的 token 数量通常降低了一个数量级


免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。