AI Pulse
📡 X 信号

Mistral转型,欧洲旗舰AI架构来自杭州

Mistral 正在成为开源中文模型的推理服务商。

3 年前,Mistral 凭借一个简单的承诺筹集了超过 30 亿美元:欧洲将拥有自己的前沿实验室。平心而论,他们有一段时间确实兑现了承诺。

Mistral 7B 和 Mixtral 都是非常出色的模型,独创的架构实力超出了参数规模,让整个行业都注意到了他们。之后发展轨迹开始变向。

他们计划在 2025 年 12 月发布的旗舰产品 Large 3,架构已经基于中国蓝图打造。配置和 DeepSeek V3 一模一样:相同的 7168 隐藏维度,相同的 61 层,MoE 前相同的 3 个全连接层,多头潜在注意力连 LoRA 秩都完全一致。

唯一的结构改动是 MoE 粒度,这个改动提升的是推理吞吐量,而非模型能力。权重是 Mistral 自己训练的,用了他们自己的分词器(词表大小 131k,DeepSeek 是 129k),所以这不只是贴了法国标签的 DeepSeek 模型。但这款欧洲主权旗舰的架构,是在杭州设计的。

现在他们彻底不装了。智谱的 GLM 5.2 作为「特色」模型放在他们平台上,未经修改直接提供服务,连中文品牌都完整保留。没有训练,没有适配,只做推理。

你从他们的招聘方向也能看出变化。曾经读起来像研究实验室的招聘页面,现在读起来就是一家服务公司:需要前置部署工程师、应用 AI、解决方案架构师,要求从售前到落地后全程对接客户。

这是给企业安装软件的人员配置,不是推动前沿发展的配置。

那个让欧洲相信自己能在前沿领域竞争的实验室,正在变成别人模型的安装服务商。而这些模型,都来自中国。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新