法国 AI 公司 Mistral 公布 1 万亿参数开放权重模型 Mistral Large 4,绰号 Le Chonk(法语意为“胖墩”)。预览版已上线,正式版本月底前发布,任何人都可以自由使用和定制。真正让这家公司底气变足的,是据当时报道在 9 月完成的一笔 33 亿美元(约 236 亿元人民币)融资:估值 240 亿美元(约 1716 亿元人民币),是欧洲科技公司史上最大的一轮;据称其收入在过去一年左右增长了约 20 倍。
参数之外,Le Chonk 的定位很具体。它虽然对标通用大模型,但被专门优化用于写代码和网络防御,以及制造、金融、电气工程等垂直场景。Mistral 联合创始人兼首席科学家 Guillaume Lample 对 WIRED 说:“有很多领域其他实验室不会投入那么多精力,而有太多领域可以改进模型。”
Mistral 把 Le Chonk 称为中国以外迄今为止最强的开放权重模型,并且与部分闭源模型“非常、非常接近”。在美国方面指称部分中国实验室借助蒸馏缩小与 OpenAI、Anthropic 差距的背景下,Mistral 强调 Le Chonk 是从零训练完成的。
对企业的账也很好算:开放权重模型的运行成本只有所消耗的算力。Mistral 的逻辑是,当开放模型与顶级闭源模型的性能差距被压到最小,同时又能替代来自中国的选项,企业犹豫要不要选开源的仅剩理由就消失了。“Mistral 仍在争夺最强模型的竞赛中,”Lample 说,“这是主要信息。”
资本和算力都不如 OpenAI 和 Anthropic 的 Mistral,在模型性能、收入和发布频率上一直落后。美国实验室靠闭源模型收高价,Mistral 则靠在自家云上按量计费跑模型,并派工程师帮客户做定制微调来赚钱。
而这轮上升期,恰好撞上美国与其跨大西洋盟友关系趋紧。据当时报道,今年 6 月,美国政府以模型可能被滥用于发动高级网络攻击为由,对 OpenAI 和 Anthropic 模型的分发施加临时限制。此后陆续曝出美国模型突破自身约束、攻击企业和部分外国政府机构的事件,如何监管模型发布争论了数周。据报道,白宫还要求美国实验室连英国 AI 安全研究所都不提供未发布模型——该机构此前一直协助评估模型的安全风险。
“美国政府可以单方面收回顶级 AI 访问权”这件事,给 Mistral 这样的欧洲开放权重实验室留出了缺口。据当时报道,欧洲政策研究中心(CEPS)研究主任 Andrea Renda 在 7 月对 WIRED 表示,欧盟追求技术主权的战略,加上美国的敌意上升,“是一个神奇配方,突然把表现并不惊艳的 Mistral 推到了有利位置”。
Mistral 并不愿意被限定只服务欧洲市场。它反复强调,对模型访问缺乏精细控制,在任何地方都可能是问题,包括美国。Lample 说,一家企业如果靠闭源模型抵御网络威胁,就等于把防御体系押在别人手里。“人们喜欢把美国、欧洲、中国拿来比较,但真正重要的是拥有模型——即使对美国公司也是这样,”他说,“如果你用的是闭源模型,没人保证它明天还在。”