智能体治理这个话题聊了大半年,大多数方案都在回答两个问题:怎么知道它跑偏了,怎么不让它越权。但 9 月 22 日 Cohesity 在新加坡 Catalyst 大会上发布的东西,回答的是被提到得更少的那个问题——它已经跑偏了、已经把数据改了,然后呢?
监控管发现,治理管约束,恢复管善后
这个新品类叫 Agent Resilience,属于 Cohesity Data Cloud 的能力扩展。CPO Vasu Murthy 的表述很直白:检测能告诉你某个智能体跑偏了,但它撤销不了智能体已经做出的改动。这句话戳中的是行业现状——观测工具越铺越多,可观测只负责「看见」,访问控制只负责「拦住」,真正出了事之后的「复原」反而没人接。
产品能力分两侧。一侧保护智能体自身:用与现有工作负载相同的快照架构、不可变备份和洁净室恢复,把智能体的记忆与配置存下来,出事后按时间点恢复到可信状态;另一侧保护智能体管的东西——数据库、文件系统等资源受影响后能精确找回。中间靠一个叫 Agent Topology 的依赖视图串起来:智能体、记忆存储、连接的应用与数据库关系一目了然,事故发生时才知道要恢复哪些。
数据背景:企业自己心里也没底
值得留意的是它对「智能体状态」的拆法。一个智能体的行为取决于记忆、配置、凭据、护栏与工作流好几个部件,这次发布先盯住记忆与配置这两块——它们是行为漂移最常见的来源,也是恢复价值最高的部分。凭据与护栏怎么纳入保护范围,发布材料没有展开,只能等后续版本补齐。
数据背景方面,Cohesity 的第五份全球网络韧性报告给了两个扎眼数字:56% 的受访组织坦言,没准备好检测或遏制智能体与自动化工作流的意外动作;58% 对遭受攻击后验证模型与数据完整性的能力没什么信心。Gartner 的预测则解释了为什么这件事现在做正合适——到 2026 年底,最多 40% 的企业应用会内嵌任务专用智能体,而一年前这个比例还不足 5%。Gartner 还给过另一条警告:到 2027 年,可能有多达 40% 的企业因为生产事故后暴露的治理问题,给自主智能体降级甚至下线。
落地节奏与更远的愿景
功能目前面向部分客户开放,正式商用目标定在年底。初期接的是 Amazon Bedrock AgentCore 与 Bedrock Agents,微软和谷歌的平台在路线图上。Cognizant 的 CIS 合作销售负责人 Srikanth Kuntamukkala 的评价侧重实操:能恢复智能体状态和它可能改过的数据,对把智能体应用推进生产环境的团队来说是更实在的风险管理抓手。
Cohesity 同时勾了幅更大的图:Autonomous Cyber Resilience 愿景,用智能体工作流自动化其五步韧性框架——保护数据、身份、应用与智能体,保持可恢复性,处置威胁,演练恢复,优化风险姿态。管理员未来可通过 Cohesity Copilot 定义恢复时间与恢复点目标,由平台评估并给出建议,执行前仍留人工审批。用智能体给智能体兜底,这个循环本身可不可靠,就是接下来值得盯的问题。
位置与清醒
放到大盘里看,Cohesity 今年 3 月已与 ServiceNow 就智能体韧性达成合作,又与 Datadog 打通观测与自动恢复。备份厂商集体向智能体灾备延伸,逻辑不难理解:智能体拿着高权限凭据批量改数据,误操作的概率和影响面都比人高,而备份恰好握着「最后一个可信时点」。当然也要留一分清醒——产品尚未正式商用,宣称的恢复能力等 GA 之后再验证。目前官方及行业暂未披露更多细节,后续将持续跟进迭代动态。