决策模型这条线,微软终于下场了
过去几个月,行业里悄悄长出一类新的模型形态:它不写文章、不聊天,只负责在关键时刻替智能体拍板,给出结构化决策,比如下一步调哪个工具、走哪条分支、要不要转人工。Jev、AWS 的 Strands Decider、Cloudflare 的 Clef 都在这条线上。10 月 11 日,微软把自家的 Microsoft-Decision-1 摆上了台面,定位也是同一类:一个不生成文本、只做高速分类与路由的模型。
有意思的地方在底座。据当日行业简报披露,这个决策模型并非微软从头训的大块头,而是基于阿里开源权重模型 Qwen3.5-9B 微调而来,已经在 Microsoft Foundry 上架,接下来还会进 OpenRouter,输入定价每百万 token 0.042 美元。换句话说,一家美国头部云厂商,把智能体最关键的一道判断闸门,架在了中国开源模型之上。
便宜、轻、快,但天花板也写在那里
把决策从大模型里拆出来单独做,卖点很直接:路由判断不需要昂贵的生成能力,用一个小模型高频跑,成本和延迟都能压到很低。0.042 美元每百万输入的定价,基本是把「在每次工具调用前问一句该往哪走」变成近乎免费的操作。对大量中低频、规则明确的编排场景,这比每次都请出旗舰模型划算得多。
但把底座交给一个 90 亿参数的开源模型,也意味着它的判断天花板就在那里。复杂因果、需要长推理的取舍,小决策模型很可能兜不住,到头来还是得把难题交回大模型。更微妙的是供应链:上游模型的许可、出口与迭代节奏,都会直接卡住下游这道闸门。目前微软尚未以独立新闻稿把训练细节、评测口径和落地边界讲透,后续仍以 Foundry 实际上架信息为准。
真正值得记一笔的,是格局本身的反转。过去我们习惯美国模型、全球调用,如今美国大厂在智能体关键层选用中国开源权重,说明开源权重的质量已经到了能扛生产级路由的程度。决策模型会不会像当年的向量数据库一样,变成智能体栈里一个标准且便宜的零件,接下来一年见分晓。