arXiv 2609.19203 是一篇立场论文(position paper),已入选 ICML 2026 立场论文赛道,9 月 16 日挂出。作者团队来自操作系统与分布式系统背景,其中包括高性能计算领域知名学者 Ian Foster。立场论文不报实验数字,专管提出「这个领域该往哪走」的论断——而这篇的论断相当直白:智能体栈缺一层操作系统。
论文的出发点是对现状的不满。AI 应用已经从单一基础模型走向复合智能体系统,协议层这一年进展很快,MCP 解决工具连接,A2A 解决智能体互联。但作者指出,即便协议把「连接」统一了,每个框架内部仍然各自内嵌一套隐式运行时:状态怎么存、记忆怎么放、预算怎么管、护栏怎么拦,全是一框架一套做法。后果有两条——行为不可移植,同一个智能体换个框架行为就变;治理脆弱,安全策略散落在各框架内部,没有集中的审计点。论文给了一个老类比:这就像操作系统诞生之前的计算世界,每个程序都得自己实现文件读写和内存管理这些基础服务。
由此提出的主张是 FMOS(Foundation Model Operating System):一个把基础模型交互虚拟化的系统层,作用方式类比虚拟机之于物理硬件——给上层应用一种「我独占一台专用、可信、能力近乎无界的模型实例」的错觉,把资源调度的复杂度吸收进层内。往里看,FMOS 要编排四件事:跨记忆分层的知识调度、模型选择与资源分配、验证与策略执行。选型与调度不再是应用开发者的负担,而是系统层的服务。
论文里最有意思的机制是「何时介入」。作者类比人脑在快直觉与慢深思之间切换:多数常规推理应该直接放行,让模型快速跑完;遇到高风险决策,系统层才介入做验证与策略检查。关键是切换规则不是写死的——FMOS 会基于运行经验持续学习何时介入、何时放行,策略随系统跑的时间越长越贴合实际负载。这把治理从一个静态的策略文件,变成了一个随运行演化的控制回路。
立场论文的价值与局限都在于它只画蓝图。虚拟化带来的开销有多大、语义级抽象会损失多少性能、治理策略如何做到跨框架可审计、这层标准由谁来定,论文都没有给出实验答案;它与产业界已有的执行层平台(编排、持久化、沙箱)边界怎么切,也要留待实践检验。但把它放进本周的语境里读,信号意义不小:产业侧 Temporal 刚用 125.5 亿美元估值证明「执行与可靠性层」是门大生意(见 1129 号稿),学术侧立刻有人论证「运行时应该整个统一收编」。本站此前跟踪的几条线——上下文来源与权限清单(1059 号稿)、企业软件按 AI Units 计价(1051 号稿)、多智能体收益取决于任务结构(1115 号稿)——拼起来正好是这层操作系统的需求侧证据:上下文要管、预算要管、协作结构要感知。协议大战之后,运行时之战可能才是智能体基础设施的下一座山头。