免费获取学习方案
ARTICLE DETAIL

资讯详情

深耕编程基础知识与建站技术分享的一线实战洞察。

Mistral 融 33 亿美元,1 万亿参数开放权重模型预览版上线

Mistral 融 33 亿美元,1 万亿参数开放权重模型预览版上线 法国 AI 公司 Mistral 公布 1 万亿参数开放权重模型 Mistral Large 4绰号 Le Chonk法语意为“胖墩”。预览版已上线正式版本月底前发布任何人都可以自由使用和定制。真正让这家公司底气变足的是据当时报道在 9 月完成的一笔 33 亿美元约 236 亿元人民币融资估值 240 亿美元约 1716 亿元人民币是欧洲科技公司史上最大的一轮据称其收入在过去一年左右增长了约 20 倍。参数之外Le Chonk 的定位很具体。它虽然对标通用大模型但被专门优化用于写代码和网络防御以及制造、金融、电气工程等垂直场景。Mistral 联合创始人兼首席科学家 Guillaume Lample 对 WIRED 说“有很多领域其他实验室不会投入那么多精力而有太多领域可以改进模型。”Mistral 把 Le Chonk 称为中国以外迄今为止最强的开放权重模型并且与部分闭源模型“非常、非常接近”。在美国方面指称部分中国实验室借助蒸馏缩小与 OpenAI、Anthropic 差距的背景下Mistral 强调 Le Chonk 是从零训练完成的。对企业的账也很好算开放权重模型的运行成本只有所消耗的算力。Mistral 的逻辑是当开放模型与顶级闭源模型的性能差距被压到最小同时又能替代来自中国的选项企业犹豫要不要选开源的仅剩理由就消失了。“Mistral 仍在争夺最强模型的竞赛中”Lample 说“这是主要信息。”资本和算力都不如 OpenAI 和 Anthropic 的 Mistral在模型性能、收入和发布频率上一直落后。美国实验室靠闭源模型收高价Mistral 则靠在自家云上按量计费跑模型并派工程师帮客户做定制微调来赚钱。而这轮上升期恰好撞上美国与其跨大西洋盟友关系趋紧。据当时报道今年 6 月美国政府以模型可能被滥用于发动高级网络攻击为由对 OpenAI 和 Anthropic 模型的分发施加临时限制。此后陆续曝出美国模型突破自身约束、攻击企业和部分外国政府机构的事件如何监管模型发布争论了数周。据报道白宫还要求美国实验室连英国 AI 安全研究所都不提供未发布模型——该机构此前一直协助评估模型的安全风险。“美国政府可以单方面收回顶级 AI 访问权”这件事给 Mistral 这样的欧洲开放权重实验室留出了缺口。据当时报道欧洲政策研究中心CEPS研究主任 Andrea Renda 在 7 月对 WIRED 表示欧盟追求技术主权的战略加上美国的敌意上升“是一个神奇配方突然把表现并不惊艳的 Mistral 推到了有利位置”。Mistral 并不愿意被限定只服务欧洲市场。它反复强调对模型访问缺乏精细控制在任何地方都可能是问题包括美国。Lample 说一家企业如果靠闭源模型抵御网络威胁就等于把防御体系押在别人手里。“人们喜欢把美国、欧洲、中国拿来比较但真正重要的是拥有模型——即使对美国公司也是这样”他说“如果你用的是闭源模型没人保证它明天还在。”
返回列表