智能体干活的质量上限,往往不在模型,而在它能不能拿到对的信息。这是 Firecrawl 这家公司存在的理由:开发者用它的 API 把网页变成干净的结构化数据,喂给智能体去研究、编码、做合规。9 月 22 日,这家公司宣布 7500 万美元 B 轮融资(由 Smash Capital 领投,Altos Ventures、Nexus Venture Partners、Y Combinator、Freestyle 与 Offline Ventures 参与),同时上线了一个名为 Alexandria 的知识库——两件事合在一起看,指向同一个判断:智能体的知识供给,正在从「随手抓」走向「供应链」。

Alexandria 是什么

按照官方博客的说法,Alexandria 给智能体一个统一的方式来发现来源、理解来源提供什么、并通过既有 API 取回信息。它把四类来源收进一个检索层:实时网页;官方数据提供商(Firecrawl 已与包括 Wikimedia Enterprise 在内的机构签了直连协议,每月有千万级的维基数据请求走它的管道);自定义连接器与企业自有工作流;再加上 Firecrawl 自建的三套索引——覆盖千万级科学论文摘要的 Research 索引、覆盖文档与已合并 PR 的 Developer 索引,以及收录法律法规的 Government 索引。官方口径称收录 1.13 亿以上索引源,通过 API、MCP 和 CLI 三种方式接入。

Alexandria:把四类来源收进一个检索层实时网页抓取 · 解析 · 变更监控官方数据提供商如 Wikimedia Enterprise自定义连接器企业自有工作流与数据Research 索引千万级论文摘要Developer 索引文档 · issue · 已合并 PRGovernment 索引法律法规与条例单一接口:API · MCP · CLI官方口径 1.13 亿以上索引源,智能体自己发现与取用内部评测:845 个任务、同模型同提示、盲评判定,答案质量较内置网页工具提升 21%
图 2|来源多元、接口单一:省掉逐源写连接器的工程量,是产品溢价所在。

效果数据要打折听:官方内部评测用了 845 个任务、同一模型同一提示词、盲评判定,结论是接入 Alexandria 后答案质量比用内置网页工具高 21%。这不是独立基准,评测集也未公开,但它点出了 Firecrawl 希望买家关注的变量——智能体的答案质量,可以用更宽、更对的来源集合换出来。这点与过去一批检索与记忆侧研究(把「答得对不对」归因到「给的东西对不对」)的思路是同频的。

真正的新意:知识开始有价格

这轮融资里更值得咀嚼的是商业模式的走向。Firecrawl 已经在给官方数据提供商付钱——Wikimedia Enterprise 是已公开的例子——并计划「很快」开放一套自助授权系统,让个人、创作者、机构把自己的知识接入智能体工作流,并按使用获得分成。官方博客把这个愿景写成一句话:让贡献知识的人分享它创造的价值。

知识供应链的付费闭环:用的人付钱,供的人分钱数据提供方维基 · 出版社 · 机构 · 个人授权接入Alexandria计量 · 定价 · 归因按用取数智能体研究 · 编码 · 合规开发者按使用付费按量分成回流已落地:Wikimedia Enterprise 直连协议,每月千万级维基请求走 Firecrawl计划中:自助授权系统,让个人与机构把「知道的东西」接入智能体并获得分成对比:此前抓取是灰色地带的「取」,现在变成有授权、有计量、有分成的「买」估值未披露;此前 A 轮为 1450 万美元(2025 年 8 月,Nexus 领投)
图 3|这轮融资真正的新意:抓取工具开始给内容方分钱,智能体的知识来源走向供应链化。

把这句话放进行业脉络里,分量就出来了。过去几年,抓取与授权之间的灰色地带是模型公司与内容方争执的火药桶;智能体时代这个问题只会更尖锐——智能体替人做研究、做尽调、做比价,每一次取数都是一次「使用」。Firecrawl 的路线是把灰色地带变成有授权、有计量、有分成的交易结构:用的人按量付费,供的人按量分成。若自助系统真的落地,它可能成为智能体经济里类似「应用商店抽成」的基础设施角色——当然,前提是量的密度撑得起这套结算体系,这块目前官方及行业暂未披露更多细节,后续将持续跟进迭代动态。

生意基本盘与竞争位

基本盘方面,公司口径称超过 150 万开发者在用其 API,官网列出 15 万家以上企业客户,包括 Shopify、Canva、Apple、DoorDash 与 Sierra。团队是 Mendable 的原班人马:CEO Caleb Peffer、CTO Nick Silberstein Camara、CGO Eric Ciarla——Mendable 时期反复撞上的「从文档和网页里拿到干净可靠信息太难」这堵墙,成了 Firecrawl 的产品母题。资金将用于搜索能力、更深索引、接入更多一方来源,以及 Alexandria 背后的支付与计量基础设施。

冷静看,这条赛道并不孤独:通用搜索厂商、数据库巨头、模型厂商自己的检索工具都在往「智能体的信息层」挤。Firecrawl 的差异位在于它同时占了「抓取工程」和「授权结算」两头——前者是脏活累活,后者是关系活,都不性感,但都难被一个周末复刻。风险也在这里:如果模型厂商把高质量检索内置成默认能力,中间层的话语权会被挤压;数据提供商若绕开中间方直连大客户,分成结构的吸引力也会打折。

从更远处看,Alexandria 与过去一个月里智能体身份、信任、支付方向的基础设施融资(如智能体商务信任层、按结果计费的智能体市场)构成同一组趋势:智能体要真正干活,缺的不只是更聪明的模型,还有身份、信任、知识和结算这些「水电煤」。Firecrawl 押的是其中知识这一格,并且选择在模型能力还在快速爬坡的窗口期,先把供给侧的关系网织起来。