法国Mistral AI推出人工智能新模型 称性能超越部分中国对手

法国人工智能初创企业米斯特拉尔(Mistral AI)10月6日发布新模型,称其在网络安全等部分领域的表现超越一些中国竞争对手,希望借此在美国和中国企业主导的全球人工智能竞赛中迎头赶上。法国负责数字事务的部长级代表称,此举再次展示了法国人工智能生态系统的能力。
这款模型正式名称为“米斯特拉尔大型模型第四代”,简称ML4,昵称为“小胖墩”。它采用开放权重模式,用户可下载模型,在自己的硬件上运行。模型目前可在米斯特拉尔的开发平台试用,权重参数定于10月27日公开。
成立于2023年的米斯特拉尔,被广泛视为欧洲挑战美国和中国人工智能企业最有实力的竞争者。此次发布距其上一次重大模型发布约五个月。今年8月,公司开始向客户提供第三方模型,首款为总部位于北京的智谱公司开发的GLM 5.3。
米斯特拉尔首席执行官阿蒂尔·门施(Arthur Mensch)在阿布扎比举行的发布会上表示:“我们今天发布的模型,在某些方面,包括网络安全,确实优于中国模型。因此,欧洲无法参与竞争的说法并不成立。”他没有说明所指的具体中国模型,也未列明作出这一比较所依据的评测标准。
目前,全球最先进的人工智能模型主要来自美国和中国,既包括开放模型,也包括由“开放人工智能”、安思、谷歌等公司开发、主要通过各自平台提供服务的封闭模型。
独立评测显示性能高于市场中位水平
米斯特拉尔表示,新模型跻身同类产品中表现最强的行列,并在编程、金融、地理空间分析、制造及产品设计等领域“缩小与前沿模型的差距”。
据公司介绍,ML4在欧洲研发,拥有一万亿个参数,可分析文字和图像,训练涵盖160多种语言。模型利用公司自有计算基础设施,在其欧洲数据中心接受了两个月的训练。
门施在社交平台X上表示,这款模型投入了大量前期准备工作,其强化学习训练“没有显示出任何趋于停滞的迹象”。
独立评测网站“人工智能分析”的数据显示,ML4预览版在该网站的综合评测指数中获得38分,高于受测模型26分的中位数。其生成速度也高于行业平均水平,与性能相近的模型相比,使用成本具有竞争力。
米斯特拉尔已公布初步基准测试结果,同时表示,模型在多个领域仍有提升空间。
法国负责数字事务的部长级代表安娜·勒埃纳夫在X上称,这再次展示了法国人工智能生态系统的能力。她表示:“看到法国创新继续前进,并在全球竞争中发挥作用,我感到自豪。”
突出网络防御能力,开放前开展安全测试
米斯特拉尔尤其强调新模型的网络安全性能,称其在网络防御以及工业、金融相关任务方面,处于开放权重模型的技术前沿。公司在声明中称,企业和政府“不应被迫依赖一家可能任意关闭其网络防御能力的封闭模型供应商”。
美国人工智能企业高管上月警告,人工智能可能对人类生存构成威胁。门施则认为,这类论调是在为相关企业自身利益服务。米斯特拉尔一直将自身定位为更安全的欧洲替代选择。
融资规模仍远逊美国巨头
此次发布距离米斯特拉尔完成30亿欧元新一轮融资尚不足一个月。该轮融资使公司估值超过210亿欧元。不过,与美国行业巨头相比,这一融资规模仍然有限。开发聊天机器人ChatGPT的“开放人工智能”今年年初融资额达1220亿美元。
斯托克表示,米斯特拉尔希望与投资方,包括阿斯麦及新投资者三星,在“整个价值链”上开展深入合作。他并称,ML4具备设计计算机芯片的能力,但拒绝透露米斯特拉尔目前是否正与三星合作开发芯片。
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.