欧洲也开源了「78B 只激活 3.46B」:主权叙事变了,技术选型没变

发布时间:2026/10/4 3:31:11

欧洲也开源了「78B 只激活 3.46B」:主权叙事变了,技术选型没变 一、发生了什么德国 AI 公司 Aleph Alpha 于 10 月 3 日发布并开源大模型 Kolibri总参数 78.1B、每 token 仅激活 3.46B激活比约 4.4%德英双语原生上下文 262,144 token、官方称测试可用到 100 万权重以 Apache 2.0 协议放上 Hugging Face随附一份 189 页的技术报告来源Aleph Alpha 官方发布文经 HuggingNews、Web Pulse、AGI Hunt 多源转述。公司把它定位为「主权模型」德国团队建造、德国与芬兰的基础设施训练、客户可完全本地化部署。二、技术拆解先看稀疏账本。Kolibri 是典型的细粒度 MoE384 个专家、每个 token 路由 6 个总参与激活比约 22.6:1。这个数字眼熟——我 9 月 29 日写 IQuest-Q1320B 只激活 15B 时数过当时一个月内四款新开源模型的稀疏比全部压在 20~24:1 区间今天这份欧洲模型落点几乎一样。模型总参激活稀疏比短板Kolibri欧洲78.1B3.46B约 22.6:1跑分全自报无第三方复现IQuest-Q1320B15B约 21:1许可证自定义需 fork 推理框架Step 5 Preview600B27B约 22:1发布时权重未开放官方称 10-15 开源LongCat-2.5-Preview约 1.6T约 480B激活比约 3.3%Preview 阶段无价格表、无第三方跑分这张表里还藏着一条暗线上下文。Kolibri 原生 262K、测试到 1M——和 9 月 25 日上线的 LongCat-2.5原生 100 万 token 上下文口径趋同。注意区分口径「原生支持」和「测试可用」是两回事262K 是设计值1M 是官方压力测试口径真用之前最好自己压测一遍。再看部署账。FP8 精度下权重大约 78GB一张 80GB 卡就能装下推理——这正是「激活 3.46B」的意义部署显存看总参推理成本看激活是两本账。9 月 21 日写 Step 5600B 只激活 27B时拆过这两本账Kolibri 是同一套算法在不同体量上的复刻。官方主打 on-premise数据不出门模型不会被别人改掉或关停。最后是「主权」具体指什么。按官方口径拆开是三件事训练全程可审计从数据摄取到评测逐环节交底并签署了欧盟通用 AI 行为准则部署完全自由合规「作为继承属性」随模型交付。有意思的是数据管线自己交了底英文语料用谷歌 Gemma 4 改写、德语用 Mistral-NeMo、质量过滤用 Qwen3-32B 打标——「无外国控制」的模型清洗数据用的是中美欧三家实验室的模型这个细节值得咂摸。三、我的判断第一稀疏带已经全球化。中国的 IQuest-Q1、Step 5欧洲的 Kolibri稀疏比全部落在 20~24:1。这不是巧合细粒度专家加小激活是当前「质量/服务成本」上最稳妥的工程解。主权叙事、地缘故事各说各的技术选型已经收敛到同一页上。第二被低估的可能是训练管线。官方博客花大篇幅讲 Model Training as Code数百个消融实验自动运行、硬件故障和数据中断不需要人介入、从 30B 的 Kolibri Origin 到 78B 的 Kolibri 发布间隔极短。对小团队来说这条「流水线复利」比单点跑分更值得抄。第三冷静剂要吃足。AIME 96.9%、「匹配四倍激活参数的模型」全部是厂商自报无第三方复现「帕累托前沿」是在自家坐标系里的比较德英双语对中文场景直接价值有限训练代码与方法不随权重开放。它是干净的 Apache 2.0但不是全部透明。四、对开发者的启示评估这类「主权/合规」开源模型建议固定四个检查项稀疏比与激活账决定推理成本、上下文口径原生值对测试值、许可证边界权重协议对训练代码归属、跑分是否自报。第一项可以自动化# moe_ledger.py —— MoE 模型稀疏账本速算defmoe_ledger(total_b:float,active_b:float,fp8:boolTrue):ratiototal_b/active_b act_pctactive_b/total_b*100weight_gbtotal_b*(1iffp8else2)band20~24:1 模板带内if20ratio24else模板带外print(f稀疏比{ratio:.1f}:1激活{act_pct:.1f}%→{band})print(f权重内存{FP8iffp8elseBF16}约{weight_gb:.0f}GB)print(f80GB 单卡可装:{是ifweight_gb80else需多卡或量化})moe_ledger(78.1,3.46)# Kolibri: 约 22.6:1FP8 约 78GB单卡可装moe_ledger(320,15)# IQuest-Q1: 约 21.3:1FP8 约 320GB需多卡真要本地部署时再补两项推理框架对细粒度 MoE 的支持程度以及长上下文下的 KV cache 显存——后者往往才是压垮单机的那根稻草。FAQQKolibri 对中文开发者有什么用A德英双语对中文业务直接价值有限但它的账本结构通用稀疏比、上下文口径、许可证拆分、合规继承这套评估框架换任何开源模型都成立。QApache 2.0 权重等于完全开源吗A不等于。权重与配置文件是 Apache 2.0但训练代码和方法的权利保留在公司手里。「能商用部署」和「能复现训练」是两件事。Q100 万上下文能直接按 1M 规划吗A官方口径是原生 262,144、测试到 1,048,576。生产环境按原生值做容量规划1M 先当实验室数字看待。上周我在《本周 AI 观察》里写 DeepSeek 把昇腾组件整套开源说硬件生态在分层那篇在这里今天这份欧洲模型是同一件事的另一半——分层之外选型在趋同。如果你更关心把模型塞进小机器那条线我之前复盘过 5.9GB 跑 27B 的三元压缩和 Kolibri 正好是开源路线的两个极端。这个专栏每天一篇 AI 解读关注不迷路。你们评估开源模型时第一个看的数字是稀疏比、跑分还是许可证—— 专注 AI 工程化实践与出海外贸技术
延伸阅读

更多相关文章

2026/10/4 3:31:11

炎症三巨头 TNF-α、IL-1β、IL-6:机制、检测与临床干预

做科研那几年,我拿到过最多的检测单不是 PCR,也不是免疫组化,而是炎症因子套餐。不管是对发热待查患者的血清,还是关节炎模型小鼠的关节匀浆,测出的第一批指标里几乎永远有 TNF-α、IL-1β 和 IL-6 这三个名字。它们被…

2026/10/4 3:31:11

OpenShell完全指南:还原Windows经典开始菜单与效率优化

如果你还惦记着 Windows 7 那个清爽的开始菜单,OpenShell 大概是现在 Windows 10 和 Windows 11 上最靠谱的还原方案。它的前身叫 Classic Shell,后来改名成了 Open-Shell,很多人干脆就直接叫它 OpenShell。这是一款开源免费的小工具&#xf…

2026/10/4 3:31:11

3分钟看懂英伟达参投Hugging Face:从模型托管到本地部署实操指南

一、Hugging Face平台架构与模型托管机制 在人工智能研发流程中,模型的开发与部署通常面临数据准备、代码编写和算力优化的多重技术门槛。2023年8月,Hugging Face宣布完成2.35亿美元D轮融资,英伟达作为重要投资方参与其中。这笔投资体现了底层…

2026/10/4 4:16:13

LabVIEW调用adb shell实现Android设备自动化测试实战指南

去年有段时间我一直在做手机产线的老化测试上位机。测的产品是 Android 系统的移动终端,但整个测试框架必须用 LabVIEW 搭,两边要联动:装 App、清缓存、模拟点击、抓日志、读系统版本、控制相机拍照,这些操作全都夹在整套 LabVIEW…

2026/10/4 4:16:13

插件加载失败排查指南:从原理到实战,覆盖IAR与MusicFree

"plugins"这个词,这几年几乎是所有软件都在提的东西。打开 IAR 遇到插件加载警告,跑测试框架报failed to load plugins web boot: 2 entries did not activate,就连手机上的 MusicFree 听歌软件,也要靠 plugins 才能解锁…

2026/10/4 4:16:13

双闭环PFC单相PWM整流原理与工程实践

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/4 4:11:13

选题毫无头绪?导师力荐这几个AI写作辅助网站

写论文总感觉无从下手?选题卡壳、思路混乱、文献难找、格式不规范……这些痛点在学术圈里太常见了。其实,只要用对AI工具、走对流程,就能大幅提升效率。不少资深教授都推荐学生提前掌握合适的写作辅助工具,让论文写作事半功倍。本…

2026/10/4 0:01:02

Jev+Agent接管浏览器:browser-use实战与jev-ultrafast性能优化

1. 从“Jev”说起:为什么我要把Agent接进浏览器“Jev”这个词最近在圈子里出现的频率越来越高,很多人第一次听到会以为是某个新模型的名字,其实它更像是一种思路——把Jev模型的能力当作底座,通过Agent的方式去接管浏览器&#xf…

2026/10/4 0:01:02

多智能体集群实战:DeepAgents编排、MCP与A2A协议及Skills体系

1. 从"单兵作战"到"集群协同":多智能体编排到底在解决什么问题如果你最近在折腾 Agent 相关的东西,大概率会有一种感觉:单个 Agent 能做的事情,其实很快就摸到天花板了。你给它一个提示词,挂几个工…

2026/10/4 1:01:05

无源低通滤波器设计实战:从RC到LC,手把手教你避开那些坑

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/4 0:01:02

Jev+Agent接管浏览器:browser-use实战与jev-ultrafast性能优化

1. 从“Jev”说起:为什么我要把Agent接进浏览器“Jev”这个词最近在圈子里出现的频率越来越高,很多人第一次听到会以为是某个新模型的名字,其实它更像是一种思路——把Jev模型的能力当作底座,通过Agent的方式去接管浏览器&#xf…

2026/10/4 0:01:02

多智能体集群实战:DeepAgents编排、MCP与A2A协议及Skills体系

1. 从"单兵作战"到"集群协同":多智能体编排到底在解决什么问题如果你最近在折腾 Agent 相关的东西,大概率会有一种感觉:单个 Agent 能做的事情,其实很快就摸到天花板了。你给它一个提示词,挂几个工…

2026/10/4 1:01:05

无源低通滤波器设计实战:从RC到LC,手把手教你避开那些坑

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑