Agent 的「手脚」正在变成一笔糊涂账:要搜网页得注册一家搜索 API,要抓社交平台得再注册一家,查企业信息、生成视频、转语音,每一件都对应一家厂商、一组密钥、一套文档和一段适配代码。2026 年 9 月上线的 Monid 想把这件事收拢成一个入口,官方给它的定位就一句话:OpenRouter for agent tools——模型那一层有 OpenRouter 做统一路由,工具这一层它想当同样的角色。一个 base URL、一个 key、一份余额,背后挂着网页搜索抓取、人物与企业数据、社交平台、评论与市场数据、视频图像语音生成等品类;10 月 1 日前后它把连接器层开源到了 GitHub(monid-ai/monid 仓库,MIT 协议)。计费模式也和订阅制划清界限:按次付费、请求没有真正交付结果就不收钱。本篇按官方路径从安装到接入 Agent 完整走一遍。
先理解:三个动词与「调用时选工具」的新模型
传统接法是集成时钉死:写代码那几天选好搜索用哪家、数据用哪家,接口就焊死在项目里了。Monid 把选择推迟到调用时,全部能力收敛成三个动词:discover 按「要干什么」搜工具,而不是按厂商名搜——它会跨厂商给整个目录排序,每个候选都带价格、实时健康状态和观测到的 p50/p95 延迟,还会提示哪个更便宜或更合适;inspect 读某个接口的输入结构、价格与文档;run 真正执行,从同一份余额里扣钱。前两个动词免费,run 按次计费。开源的部分是连接器层:每个接口由两个声明式文件描述(provider 声明身份、认证方式与计费模型,endpoint 声明请求与输入结构),编译成内容哈希引用的「密封单元」交给引擎执行——同一个产物可以不改一行地跑在本地(用你自己的厂商 key)、CI(对着录制好的响应回放、完全不联网)和托管平台(凭证由传输层注入、密钥不进引擎进程)三个地方。
工具数量各处口径不一致,别拿具体数字当定论。官方 README、官网首页与开源仓库分别给出过不同的厂商与工具数量(仓库只是连接器层,托管目录里还有未入仓的部分,例如大量 Apify actor)。本教程统一按「上千个工具」这个量级理解,动手前以 monid.ai/tools 实时目录为准。
Step 1:安装 CLI 并完成 setup
# 全局安装 Monid CLI
npm install -g @monid-ai/cli@latest
# 初始配置:完成账号绑定与密钥配置
monid setup
# 验证安装与登录状态
monid --help
CLI 是使用方最顺的入口,npm 上一条命令装好。monid setup 负责把你的账号凭据落到本地配置,后续 discover 与 run 都走同一份身份,不需要再逐个厂商申请 key——这正是它替代的那段脏活。安装完先跑 monid --help 确认子命令齐全。如果你更习惯走 Agent 内置路径,可以跳过本步直接看 Step 5 的 SKILL.md 与 MCP 接入,两条路殊途同归,区别只是「人用 CLI」还是「Agent 自己调」。
Step 2:discover——按意图搜工具,而不是按厂商名
# 按意图搜索:想抓推特上的帖子
monid discover -q "twitter posts"
# 返回的每个候选大致包含:
# - 接口名称与所属厂商
# - 单次调用价格
# - 实时健康状态
# - 观测到的 p50 / p95 延迟
# - 提示:哪个候选更便宜或更合适
discover 是整个模型的核心:你描述任务而非厂商,它对整个目录跨厂商排序。排序结果里最有价值的是价格与延迟并列外显——同样抓一批帖子,两家候选可能差出几倍单价,p95 延迟还会告诉你谁在高负载时段更稳。选型经验从「读文档比较」变成「看一眼榜单」,这对临时性、一次性的数据需求尤其友好:不必再为一个偶发任务走完注册、充值、读文档、写适配的完整流程。搜索是免费的,放手多试几个关键词,观察同一意图下不同措辞召回的候选差异,很快就能建立手感。
Step 3:inspect——看清输入结构与价格再动手
# 对选中的接口做调用前检查
monid inspect <接口标识>
# inspect 返回的关键信息:
# - 输入参数结构(必填与可选)
# - 计费模型:按次 / 按结果条数 / 按单位
# (例如每千字符、每秒视频)
# - 接口文档要点
inspect 对应的是传统流程里「读 API 文档」这一步,但读的东西薄了很多:输入结构、计费单位、文档要点。特别值得看的是计费模型——Monid 的连接器在定义里声明自己的计费方式,同样是「一次调用」,搜索类可能按次、数据类可能按返回条数、视频生成按秒计费。搞清计费单位再估算批量任务的成本,才不会被账单惊喜。免费动词大胆用:discover 和 inspect 都不扣费,run 之前把候选摸透是标准动作。
Step 4:run——执行调用,失败不收钱
# 执行调用(以 CLI 帮助给出的实际语法为准)
monid run <接口标识> --input '<按 inspect 的结构填参数>'
# 计费行为(官方口径):
# - 用量在「原始响应」上结算,早于任何输出映射
# - 厂商报错、公司没匹配上、人没查到:
# 当作正常数据返回,按零结算
# - 厂商非 2xx 响应在 Monid 里是数据,不是异常
run 的计费设计值得单独讲:结算发生在原始响应上——引擎在把输出映射成业务结构之前就按真实返回算清了用量,计费依据就是你真正从线上拿回来的东西。配套的规则是「失败不收钱」:厂商报错、查询没有命中目标,这些都被当作正常数据返回、按零结算,而不是抛异常让你重试到怀疑人生。这让「按次付费」在工程上变得可接受——你付的钱和拿到的结果严格对应。注意 CLI 的确切子命令与参数以 monid --help 和 docs.monid.ai 为准,不同版本可能有细节调整。
按次付费没有「包月上限」托底。Agent 在运行时自己挑工具、自己花钱是这套模式的前提,也意味着失控时烧钱是实时的。给 Agent 用之前先设余额上限或告警,批量任务先用小样本估单价,再放大规模。
Step 5:接进你的 Agent——SKILL.md、远程 MCP 与 CLI 三条路
# 路线一:技能文件(在 Agent 对话里直接说)
# setup https://monid.ai/SKILL.md
# 适用于 Claude Code、Codex、Cursor、
# OpenClaw、OpenCode 等支持技能的运行时
# 路线二:远程 MCP 服务
# 把 Monid 提供的远程 MCP 端点
# 按你所用客户端的 MCP 配置方式接入
# 路线三:CLI(Agent 通过 shell 工具调用)
# 适合自研 harness 或脚本化流水线
接入层是 Monid 特意做薄的地方:一条 SKILL.md 指令、一个远程 MCP 端点、或干脆让 Agent 用 shell 调 CLI。官方的 SKILL.md 写得相当克制,里面有条明确的边界条款:如果你已经有某个服务的专用 MCP、自己的 API key 或现成流程,Agent 应该用你自己的,别绕到 Monid 上花钱——Monid 只补工具栈里的空缺。这条条款建议原样保留在你的 Agent 约定里,否则容易出现「明明天已有免费专用通道,Agent 却图省事走付费市场」的行为。三条路线怎么选:个人探索用 SKILL.md 最多五分钟见效;团队生产环境倾向远程 MCP 加统一余额治理;自研 harness 用 CLI 最透明。
Step 6:给自家 API 上架,让全世界的 Agent 调用你
# 贡献方流程(需要 Deno 2.x):
git clone https://github.com/monid-ai/monid.git
cd monid
# 本地验证:类型检查 + 188 个离线回放测试,不联网
deno task check && deno task test
# 写法参考:connectors/ 目录下的参考实现;
# 仓库内还有写给编码 Agent 的 AGENT.md——
# 把它、你家的 API 文档、参考实现一起交给
# Claude Code 或 Codex,让 Agent 帮你写定义
开源连接器层的意义在供给侧:你写好 provider 与 endpoint 两个声明式文件、录一份测试夹具,本地跑通类型检查与离线回放测试,提 PR 合并后你的接口就进了 discover,所有 Agent 都能搜到、能付费调用。CI 只做类型检查加回放,写出来的东西要么符合约定、要么编译不过,人工评审只需看「描述得对不对」。官方 README 里有句给贡献者的建议值得抄下来:把 meta.description 当产品来写——它是 discover 排序的依据,也是 inspect 返回给 Agent 读的内容,写清楚能做什么、不做什么、什么时候该换另一个接口。
上架是商业行为,定价要自己算清。Monid 在底层厂商价格上加 10% 作为渠道费,你的接口定价策略、成本结构、退款口径都由 provider 定义声明并对外可见——按次计费意味着每一笔都是真金白银,别照抄别家的数字。
预期效果与自检清单
全部跑完后,你应该达到:CLI 安装并 setup 完成,monid --help 子命令齐全;用 discover 按意图搜出候选并能读懂价格、健康度与延迟字段;inspect 后用 run 完成至少一次真实调用,账单与预期一致;Agent 侧至少走通一条接入路径(SKILL.md / MCP / CLI),并验证过「已有专用工具时优先走专用通道」的边界条款;有意向的开发者本地跑通了 deno task check 与回放测试。回到定位本身:Monid 押注的是「Agent 在运行时自己挑工具、自己结账」会成为常态——模型层的 OpenRouter 已经验证了这条路,工具层谁先把计费做得让 Agent 敢花钱,谁就站住了。你现在可以用赠送额度把整条链路亲手跑一遍,再判断它值不值得进你的工具栈。