当地时间10月6日,法国人工智能公司Mistral AI正式推出Mistral Large 4模型的公开预览版(Public Preview),简称ML4,内部代号le Chonk。即日起,用户可通过Mistral Studio体验预览版API,模型权重计划于本月底正式开放下载。
据官方介绍,ML4是一款拥有1万亿总参数、490亿激活参数的原生多模态模型。Mistral方面表示,该模型在实测中的表现足以媲美全球顶尖的开源模型,并大幅领先于欧美地区开发的所有开放权重模型。在网络安全、金融与法律等关键企业级工作负载中,ML4在所有开源模型中均达到SOTA水平。在视觉定位等特定领域,其表现甚至超越了当前的前沿闭源模型。
训练基础设施方面,ML4在Mistral位于欧洲的自建数据中心内完成训练,基于3,800块英伟达Grace Blackwell GPU从零开始构建。Mistral强调,其欧洲部署方案完全由公司端到端独立运营,严格遵循欧盟法律法规,不受制于任何第三方数字服务提供商。这一表述凸显了Mistral在欧洲AI主权议题上的定位。
多语言能力是ML4的另一显著特征。其训练语料覆盖超过160种自然语言,全面囊括欧盟所有官方语言。这一设计与其欧洲市场定位密切相关,也回应了欧盟对多语言AI服务的合规要求。
定价方面,ML4每百万tokens输入收费1.36美元,每百万tokens输出收费4.18美元。目前,Mistral正联合顶尖网络安全机构、受信任的合作伙伴及政府监管部门,在真实业务环境中对模型展开红队测试。相关合作方将获得专项测试访问权限,测试版本适当放宽了内容安全审查策略,并强化了网络安全攻防技术能力。
Mistral AI成立于2023年,由前Meta和Google DeepMind研究人员创立,此前已推出Mistral 7B、Mixtral 8x7B等多款开源模型,并获得包括a16z、Lightspeed Venture Partners及多家欧洲机构在内的多轮融资。该公司一直将自身定位为欧洲AI领域的领军者,强调开源策略与数据主权。
此次ML4的发布,正值全球大模型竞争持续升温之际。开源与闭源模型的能力差距逐步缩小,而企业级市场对模型的安全性、合规性及部署自主权的要求日益提高。Mistral以欧洲自建数据中心、独立运营及多语言合规为差异化卖点,试图在由美国科技巨头主导的AI格局中开辟独立路径。ML4的实际表现与开发者反馈,将在月底权重开放后得到进一步验证。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。