主权 AI,变成一份可以下载的权重
10 月 3 日,德国统一日当天,海德堡公司 Aleph Alpha 在 Hugging Face 开源了 Kolibri-1:一款面向德英双语的混合专家(MoE)大模型,权重以 Apache 2.0 许可证发布、允许商用,同时附上一份 189 页的技术报告。德国数字事务部长 Wildberger 出席了在海德堡的发布活动。这家把「欧洲主权 AI」喊了多年的公司,把过去停留在采购蓝图上的承诺,交割成了一份人人可下载的文件。
按模型卡口径:总参数 781 亿,每个词元激活 34.6 亿(约 4.4%);50 层全部为 MoE 层,共 384 个专家,每个词元按路由激活 6 个、外加 1 个共享专家(部分报道写作 8 个激活,以模型卡 6+1 口径为准);原生上下文 262,144 词元,官方称已验证至 1,048,576 词元,同时建议生产服务中不超过 262K,以保证效率与复杂任务质量。权重以 FP8 精度发布,体积约 78GB——最低可在两块 A100 80GB、两块 H100 或单块 H200/B200 上运行。
21 天、768 块 B200、全部在欧洲
训练侧的信息披露相当完整:预训练动用 768 块英伟达 B200(96 个 HGX 八卡节点),全部位于德国与芬兰的基础设施上,耗时 21 天;预训练消耗 20 万亿词元,中训练追加 3.44 万亿,长上下文适配再消耗约 2,010 亿,合计约 23.6 万亿词元。数据构成上,英语约六成、德语约两成、代码约一成半——对一款双语模型来说,这个德语配比相当舍得,配套的 UniBPE 分词器也专门为德语压缩率做了调优。知识截止日期为 2026 年 6 月 18 日。
公司强调整条流水线——数据收集、预训练、后训练到优化——均由自有团队在德国与芬兰完成,受欧洲与德国法律管辖。对目标客户(公共行政、工业、航空航天与国防)来说,这套「可审计的出身」正是卖点:发布即同步公开欧盟 AI 法案要求的训练内容摘要,公司已签署欧盟通用 AI 行为准则,数据处理流程考虑了 GDPR。
不设 API:商业模式本身就是立场
一个容易忽视的细节:Kolibri 发布时不提供官方托管 API。想用它的机构只能把权重拉回自己的基础设施——这意味着客户数据不出网、没有遥测回流,访问控制由买方自己掌握。Aleph Alpha 不靠按词元计费赚钱,收入来自部署、集成与支持合同。它把「主权」做成了一件可以验真的生意:如果欧洲机构真愿意为数据驻留与许可控制付溢价,模式就成立;反之,这份权重就只是 Hugging Face 上又一条下载记录。
成绩单:厂商口径漂亮,独立检验存疑
官方评测给出的数字相当亮眼:综合得分英语 75.5、德语 70.8,高于 Nemotron 3 Super(120B,73.0/67.9)、Qwen3.6-35B(71.4/67.3)与 Mistral Small 4(63.1/61.4);AIME 2025 拿到 96.9。但这份对比表的对手由厂商自选、测试配置自定,应按厂商自述口径看待;HumanEval+ 上 92.7 分实际落后 Nemotron 3 Super 的 94.7,已说明并非全面领先。
独立侧的信号则要冷静些:据 beckmann.ai 援引的 Orcarouter 独立分析,在通用语言理解上 Kolibri 落后于 270 亿参数的 Qwen3.8;不过同一份分析的德语数学测试(AIME 2025 德语版)中,它拿到 87.5 分、超过同组多款更大的模型。另一项厂商自述的抗幻觉设计也值得追踪:通过「Merlin-Arthur」协议训练——一方隐匿证据诱导模型作答,正确策略是承认不知道——Kolibri 在自身不知道的问题上选择拒答的比例从上一代的 15% 升至 44%(厂商自测口径)。
合并阴影下的时间窗口
发布的时间点同样微妙:Aleph Alpha 与加拿大 Cohere 的合并已于 9 月敲定,仍待多个司法辖区反垄断审查,交易完成前海德堡团队保持运营独立。这次约 200 人团队的全自研交付,被德国媒体解读为向监管方与客户证明「海德堡不只是研发卫星办公室」。三个月前(6 月 11 日),公司刚发布 306 亿参数的前身 Kolibri Origin 作为基础设施试运行;从试运行到 781 亿正稿只用了约三个月,这条「模型工厂」式的迭代节奏,或许比单个模型的跑分更能说明这家公司的工程底子。
观察点有三个:独立基准何时补测德语长上下文与工具调用表现(模型自带 Hermes 风格工具调用与四档推理投入设置);欧洲公共采购会不会给出真实订单;以及合并完成后、需要 vLLM 插件才能部署的服务生态是否延续。目前官方及行业暂未披露更多细节,后续将持续跟进迭代动态。