发现最适合你的
AI 智能体与编程助手

全面收录 OpenClaw、Hermes Agent、KimiClaw、Cursor 等 206+ 款智能体 · 多维基准评测与选型指南

🦞 产品大全 共 226 款

Google Antigravity

Google

🔥 热门 ✨ 新 🎁 免费

Google Antigravity 是 Google 推出的面向 AI 智能体全生命周期开发的新一代集成开发环境,基于 VS Code 内核重构,整合了 Google 以24亿美元收购的 Windsurf 团队技术。由 Gemini 3 Pro 驱动,提供浏览器内智能体、自动化UX开发、全栈应用构建能力,Agent-First 设计理念。2026年5月19日 Google I/O 2026 发布Antigravity 2.0重大升级——从IDE转型为通用Agent优先工作平台:Manager Surface(独立面板维护持久项目上下文——架构/目标/变更历史,跨会话减少摩擦)+ Jules异步编码Agent集成(IDE内提交任务后台执行+创建PR+审查)+ Gemini 3.5 Flash支持+ 多智能体并行调度(同时部署多个子Agent分别处理不同任务)+ /schedule定时任务(一次性/周期性)+ /goal连续目标命令+ /grill-me需求澄清命令+ /browser显式浏览器调用+ 项目管理重构(workspace→project,可对应多文件夹+独立Agent设置+权限边界)+ 全新Antigravity CLI(建议Gemini CLI用户迁移,更轻量高速)+ 可本地部署SDK+ Managed Agents(1次API请求启动隔离Linux环境+持久保存,通过Gemini API接入)。

免费
A
大厂 云端 热门

Bolt.new

StackBlitz Inc.

🔥 热门 ✨ 新 🎁 免费

Bolt.new 是 StackBlitz 推出的浏览器内 AI 应用构建器(2024 年 10 月发布),通过 WebContainers 技术在浏览器中运行完整的 Node.js 环境。用户用自然语言描述想法,AI 即可生成完整的全栈 Web 应用(React/Next.js/Svelte/Astro/Vue 等多种框架)。支持实时预览、一键部署、版本历史、团队协作。Bolt V2 新增 Bolt Cloud 云端部署能力。5M+ 用户,$135M 融资。免费版可用,Pro $20/月,Pro Unlimited $100/月。与 Replit Agent、Lovable、Base44 等构成 AI App Builder 赛道核心竞争者。

免费
B+
云端 热门

Bullet

Bullet(YC S26,Adi Kulkarni & Alex Sima)

🔥 热门 ✨ 新 🎁 免费

Bullet 是 Y Combinator 2026 夏季批次(YC S26)孵化的极速编程 Agent,由 Adi Kulkarni 与 Alex Sima 创立。其核心论点与主流「堆模型」路线相反:模型已经足够强,瓶颈在模型周围的「机械结构」(harness)——等待 agent 跑完的时长是开发者最大的痛点。Bullet 因此把「延迟」本身当作产品来优化,而非副作用。它不自己训练模型,而是把你已有的 Claude Code / Codex 订阅接进来(BYO 订阅,也支持 API Key 与本地模型),通过三层架构优化压缩往返次数与单任务耗时:① 智能模型路由(Smart Model Routing)——简单步骤(读文件、查路径、跑测试)路由给快模型,只有真正需要时才升级到强力模型;② 目标化代码搜索(Targeted Search)——放弃把整个仓库 embed 进上下文,改用更快的 grep 式检索拉取少数相关文件;③ 并行工具执行(Parallel Tool Execution)——独立读文件/搜索/命令并行而非串行,并拦截重复调用与卡死循环。创始人自报在 SWE-bench Verified 上单次尝试解决 479/500(95.8%)、平均 119s/任务,较 mini-SWE-agent + Fable/Sol 快 35–67%,内部测量显示往返(round-trip)减少 16%、成本降低 27%。产品以 CLI 形式通过 `npm install -g @trybullet/cli` 安装,支持 macOS 与 Linux,当前为免费私有 Beta、商业模型待定。Hacker News 社区对其核心论点(agent 已从「模型能力竞争」转向「工程效率优化」)评价正面,但也指出其差异化多为业界共识(并行工具调用、grep 优先检索、上下文卫生均非首创),真正独有且未纳入基准测试的是「逐步骤模型路由」,且封闭源码、依赖 Claude/OpenAI 订阅通道(Anthropic 已多次封禁第三方 harness 的订阅 OAuth)是增长与信任上的潜在隐患。

免费
B+
终端 热门

Claude Code

Anthropic

🔥 热门 ✨ 新

Claude Code 是 Anthropic 推出的 AI 编程代理(Coding Agent),可在终端、VS Code、JetBrains、桌面应用、Web 和 Slack 多种环境中运行。由 Claude Opus 5(默认 Opus 模型,1M 上下文)驱动,具备深度代码库解读、跨多文件协调编辑、Issue 自动转 PR、智能搜索等核心能力。支持 Routines 定时/触发自动化任务、Auto Mode 安全长时间运行、Fast Mode 2.5倍加速模式。支持 GitHub/GitLab/Jira/MCP 等开发工具集成。安全方面采用本地运行设计,修改文件或运行命令前需用户批准。个人版 $20/月起(年付 $17/月),Max 5x $100/月,Max 20x $200/月,企业和团队方案定制。被 Uber/Spotify/Stripe/Shopify/NASA/Figma 等知名企业广泛采用。

$20/月
S
云端 热门

飞书 CodeM

字节跳动 · 飞书

🔥 热门 ✨ 新

飞书 CodeM 是字节跳动飞书于 2026年7月15日正式发布的原生 AI 研发智能体,面向研发团队提供覆盖协作、开发、交付全流程的自动化能力。它并非单纯提升单人编码速度,而是打通飞书项目、飞书群聊、在线文档与代码仓库,串联起团队协作、开发流程与代码运行全环节。研发团队只需下达任务指令,CodeM 即按标准化研发流程自主开展工作,依次完成开发、验证、信息同步直至交付。CodeM 支持多渠道启动:飞书私聊对话、群内 @呼叫、飞书项目 AI 节点、桌面客户端、命令行工具 CLI。依托飞书原生生态,CodeM 在群聊内 @该智能体即可启动完整需求研发流程——自动读取群聊记录、项目文档与项目信息梳理需求背景,自主完成编码、修改、验证并留存节点记录,经确认后自动上传代码,提审操作在飞书内完成,项目进度同步更新至飞书项目,全程无需跨平台跳转。CodeM 采用 Agent 执行 Daemon 架构,Agent 跑在用户本地机器,提供 Bot/CLI/桌面应用三种入口与多设备绑定;通过云端沙箱隔离执行(动态 Token 管控、用完即销)、读写与执行分级授权、数据自主可控,实现企业级安全治理。

免费
A
企业 热门

CodeWhale(原 DeepSeek-TUI)

Hunter Bown (Hmbown)

🔥 热门 ✨ 新

CodeWhale(原 DeepSeek-TUI)是独立开发者 Hunter Bown 推出的终端原生 AI 编程 Agent,已于 2026 年 6 月正式更名为 CodeWhale。采用纯 Rust 编写,专为 DeepSeek V4 模型深度优化,支持 1M Token 上下文窗口,提供 Plan(只读探索)、Agent(交互审批)、YOLO(自动批准)三种工作模式。内置文件操作、Shell 执行、Git 管理、Web 搜索/浏览、子智能体、MCP 服务器等完整工具套件。支持 Windows/macOS/Linux 多平台,可通过 npm install -g codewhale 等 6 种方式安装。已获 29.3K GitHub Stars,被誉为「DeepSeek 版 Claude Code」。MIT 开源协议完全免费,仅需自备 API Key。旧名称 deepseek-tui 仍可作为兼容 shim 使用,计划在 v0.9.0 移除。

免费
A
开源 热门

Codex CLI

OpenAI

🔥 热门 ✨ 新 🎁 免费

Codex CLI 是 OpenAI 推出的本地运行AI代码智能体,2025年6月用Rust重写。不强制要求OpenAI官方账号,支持通过配置第三方模型(DeepSeek、Gemini、Ollama等)或API中转服务灵活使用。提供三种审批模式(suggest/auto-edit/full-auto),终端内即可完成代码编写、文件操作和命令执行。v0.139.0(6月9日,稳定版):网络搜索增强(代码模式直接调用独立网页搜索)+工具模式改进(保留oneOf/allOf结构,提升MCP兼容性)+诊断工具升级(codex doctor包含编辑器和分页器环境)+插件市场自动化(--json输出市场来源)+多项TUI和沙箱修复。v0.138.0(6月8日,稳定版):/app命令将CLI线程切换到Codex Desktop(macOS/原生Windows)+图片附件暴露文件路径+推理努力选择备用快捷键+插件自动化增强(--json结构化输出)+TUI性能和修复。v0.136.0(6月1日,稳定版):TUI Markdown链接支持OSC 8元数据+拥挤表格自动切换键值对格式;新增/archive命令归档会话+codex archive/unarchive命令行操作;远程执行支持CODEX_API_KEY注册+WebSocket短生命周期令牌;Windows沙箱alpha级配置(codex sandbox setup --elevated);可选原生图像生成扩展(功能门控);修复ChatGPT认证令牌刷新窗口优化+命令安全加固(防止/diff运行仓库Git钩子)+沙箱中断后清理可靠性提升。v0.135.0(5月28日,稳定版):新增 codex doctor 命令(环境/Git/终端/应用服务器/线程库存诊断)+ /status 显示远程连接详情和服务器版本 + Vim模式增强(文本对象编辑/优化单词行尾行为/配置中断轮次快捷键)+ /permissions 支持命名权限配置文件 + 打包Codex构建支持识别和启用捆绑的补丁zsh辅助工具 + Python SDK新增线程和轮次API的友好 Sandbox 预设 + install.sh/install.ps1 支持 CODE_CODEX_NON_INTERACTIVE=1 非交互安装模式;Bug修复:TUI中Markdown表格/多行列表渲染优化(列宽更合理)+ 修复macOS和Zellij下的TUI输出稳定性问题 + 斜杠命令补全保留内联参数命令的已有草稿文本 + 修复旧版tmux/iTerm控制模式会话丢失 Ctrl-C 处理 + 应用提及排除不可访问或禁用的应用;文档更新:澄清图片查看工具行为描述 + 更新Python SDK文档/示例/笔记本内容。

免费
A-
开源 本地 免费

Cursor

Anysphere

🔥 热门 ✨ 新 🎁 免费

Cursor 是 Anysphere 推出的 AI 原生 IDE,2026 年 4 月发布 Cursor 3(代号 Glass),将 AI Agent 提升到第一优先级。支持多 Agent 并行协作、Composer 2.5 自动编排(5月18日发布,10倍成本效率提升),从代码编辑器进化为智能体控制台。6月10日 Bugbot 重大升级:运行速度提升3倍(平均约5分钟→90秒)+每次运行成本降低22%+Bug发现率增加10%(0.56→0.62个/次)+支持推送前/review命令+智能PR重审(仅审查新增变更)。5月29日 v3.6 发布:Auto-Review 自动审查运行模式,允许列表内调用可立即执行、沙箱可运行调用在沙箱中执行,其余操作由分类器子智能体判断处理方式,可在设置中配置运行模式,还能为分类器智能体提供自定义指令。2026年5月20日 v3.5 发布:共享画布(Shared Canvases)让团队分享Agent创建的交互式仪表盘/报告/自定义界面,支持实时快照链接+只读Dashboard查看;Automations 自动化升级至Agent窗口,支持多代码仓库和无需仓库的自动化场景(5个新增无代码模板:Slack摘要/产品分析/产品FAQ/财务/客户健康监控)。2026年4月22日,SpaceX 旗下 SpaceXAI 与 Cursor 达成战略合作协议,获得以600亿美元全资收购的选择权,或支付100亿美元推进深度合作,双方将联合打造全球最优秀的编程与知识型AI。

免费
S
云端 热门

豆包工作

字节跳动(ByteDance)

🔥 热门 ✨ 新 🎁 免费

豆包工作(Doubao Work)是字节跳动于 2026 年 8 月 25 日正式发布的、面向生产力场景的全新 AI 办公智能体产品与品牌。它围绕用户目标自主拆解复杂任务、调用内置工具、持续推进工作流,并在获得授权后跨软件操作浏览器与电脑,长时间任务可调用云电脑继续执行、本地关机也不中断。产品与飞书深度打通,可基于企业文档、群聊、多维表格等组织上下文更准确地完成任务,自动创建任务、发私信提醒进度并将交付物回写飞书。豆包工作的界面已从对话式 AI 助手转向能承接复杂工作流的操作中台,引入框选编辑(对文档/表格/PPT 直接框选局部修改)、技能商店、连接器与工作伙伴等能力,并支持多个 Agent 组成工作小队分工协作。此前字节已将飞书产品团队(7/30)、TRAE 与扣子(Coze)团队(8/24)并入豆包体系,集中发力 AI 办公赛道。电脑版已可通过豆包官网下载,用户可在最新豆包电脑版中直接使用。

免费
A-
大厂 云端 热门

豆包工作伙伴

字节跳动 × 飞书

🔥 热门 ✨ 新

豆包工作伙伴是字节跳动在 2026 年 9 月 15 日「2026 飞书未来无限大会」随飞书 8.0 同步发布的国内首款团队智能体(team agent)产品。它不同于面向个人的 AI 助手,而是拥有独立身份、权限与记忆系统的「数字同事」,能够像真实员工一样被拉入飞书群聊,自动完成信息同步、文档审校、周报整理等标准化工作,并在授权范围内操作企业业务系统。飞书 8.0 本身全面向 Agent 开放数据与工具能力:开放 767 个 CLI 功能点(较 3 月上线时增加 520 个),Agent 现已具备撰写文档、操作多维表格、安排日程、参与会议等完整办公能力;多个智能体还能自主完成跨任务配合。针对企业安全管控,飞书构建了三级权限体系——Agent 权限与使用者完全一致、管理员可统一追溯使用记录、设定 AI 用量上限并管控高消耗模型场景。某汽车零部件企业试用显示,该产品使跨部门协作效率提升 40%、重复性工作减少 65%。目前处于与企业定向共创阶段,后续将逐步向客户开放。

未公布
A-
大厂 团队Agent 办公

Gemini Spark

Google(Alphabet)

🔥 热门 ✨ 新

Gemini Spark 是 Google 于2026年5月19日 Google I/O 2026 发布的24/7全天候个人AI Agent,定位从'你问我答'的对话式AI升级为能主动执行任务的数字伙伴。运行在Google Cloud为每个用户分配的专属VM上,不依赖用户设备——手机锁屏、笔记本关机、断网时仍然持续工作。深度集成Google Workspace(Gmail/Calendar/Drive/Docs/Sheets),所有连接默认关闭需用户主动开启。支持用自然语言下达单次或多步骤任务(Tasks)、'教'Spark学会新任务后重复执行(Skills)、设定周期性规则自动执行(Schedules)、同时处理多个任务流(多线程并行)。通过MCP协议连接第三方服务,首批合作方包括Canva/OpenTable/Instacart。涉及高风险操作时请求用户确认。任务状态和进度在所有设备上同步。目前Beta阶段,仅向美国地区Google AI Ultra订阅用户开放($100/月)。

$100/月
A-
云端 付费

GitHub Copilot

GitHub / Microsoft

🔥 热门

GitHub Copilot 是 GitHub(Microsoft)推出的 AI 编程助手,1500 万+ 开发者使用,是用户量最大的 AI 编程工具。2026 年 3 月 Agent 模式在 VS Code 和 JetBrains 全面 GA,可自主规划并执行多步骤编码任务(确定修改文件、跨文件编辑、运行终端命令、检查输出并迭代)。更进一步,Coding Agent 支持将 Issue 自动分配后完成分支创建/代码编写/测试运行/PR提交的完整闭环。代码审查升级为 Agentic Architecture,可自动修复审查发现的问题。支持 Semantic Code Search 语义搜索。6 月 9 日起全面支持 Claude Fable 5 模型。6 月 1 日起转为 Premium Requests 按量计费制(Free $0/50次,Pro $10/月/300次,Pro+ $39/月/1500次,Business $19/用户/月,Enterprise $39/用户/月),超量 $0.04/次。支持 VS Code/JetBrains/Eclipse/Xcode/GitHub.com/GitHub Mobile/Windows Terminal 多平台,16 年对已认证学生/教师/开源维护者免费。

$0
S
云端 热门 IDE

🎯 场景选型矩阵

🔰
零基础小白
MaxClaw
备选:KimiClaw
💬
微信重度用户
QClaw
备选:OpenClaw
🪁
飞书企业团队
ArkClaw
备选:MaxHermes
📎
钉钉企业
QwenPaw
备选:DTClaw
🔬
研究/法律/长文档
KimiClaw
备选:OpenClaw
🛠️
开发者/极客
OpenClaw
备选:Hermes Agent
🧠
OpenClaw迁移/自进化需求
Hermes Agent
备选:MaxHermes
🏦
金融/政府/高合规
NemoClaw
备选:DTClaw
📱
小米生态用户
Xiaomi miclaw
备选:QClaw
🎓
教育/学习场景
LobsterAI
备选:KimiClaw
🛡️
安全优先用户
360安全龙虾
备选:NemoClaw
🏄
AI IDE 云端编程
Windsurf
备选:Cursor
免费终端 Agent
Gemini CLI
备选:OpenCode
🌀
云端异步/跨国协作
Mistral Vibe
备选:Hermes Agent
🎯
通用任务自动化
Manus
备选:MaxClaw

📰 智能体资讯

查看全部 →
研究解读

跑十天不出戏:一套给长时程 agent 的架构三分法

arXiv 2609.19519 主张长时程 agent 要「先能持续运行不遗忘,再谈持续学习」,答案在 harness 而非模型:按时间尺度分层、每层一份有界摘要文件;以时钟节拍为自主行动单元;级联智能——评审不过才升级到更强模型。十天战役中 agent 在人类每天查看一次的值守下,跨过每次上下文重置复现了一项强化学习结果。

2026-09-18
产业观察

文档的主要读者换成了智能体:一份报告里的数字与错位

Mintlify 9 月 17 日发布 2026 知识状态报告:8 月其托管站点上 agent 请求 2.57 亿次、人类访问 1.31 亿次,接近二比一;llms.txt 导航让失败请求降 20 倍、token 最高省六成;83% 受访企业已让 agent 起草文档更新,但只有 9% 免审发布。Gartner 口径:仅 14% 的组织对内部内容可供 agent 使用有信心。

2026-09-18
研究解读

车载语音的授权坎:202 个场景考出两到三次误执行

arXiv 2609.19630 隔离「执行前的授权决策」:执行、拒绝、澄清、要求确认、转人工、紧急响应、不调工具七类参考动作,横跨说话人角色、认证状态、车辆状态与工具可用性四个维度。前沿模型对齐率 89.1%,但在 161 个不该执行的场景里仍出现两到三次误执行;结构化授权策略把小模型从 29 左右拉到 40.1,却消不掉误执行。

2026-09-18
研究解读

企业系统里的隐形规则:让 agent 自己养一份会过期的世界模型

arXiv 2609.19551 提出 EnterpriseWorldShift:基于真实 ServiceNow 环境,9 张表、25 条隐藏业务规则、600 个评测动作,规则被改、增、撤四轮考验持续发现与修订。其 CDA 方法把隐藏规则效果预测较逐题查询最高提升 8.98 个 IoU 点,且不查运行中的生产系统即可作答。

2026-09-18
研究解读

「到达」还是「解决」:agentic RL 的收益可能被读错了

arXiv 2609.19636 指出 agent 在闭环里写自己的输入,SFT 与 RL 检查点即便跑同一批任务,面对的状态分布也不同——直接比分分不清「决策更好」还是「运气好」。检查点交接法在 ALFWorld 上分解:24.2 个百分点的交互增益中,交互预测占 20.7,大头来自「到达了更好的状态」。

2026-09-18
研究解读

agent harness 到底值多少:规划加七个点,验证只要一分钱

arXiv 2609.20474 用「固定计划对照同长乱序文本」的 Sham 设计隔离规划贡献:265 个配对单元上 oracle 验证成功率提升 7.17 个百分点,收益集中在高复杂度任务;只读终局验证器每集不到一美分,拦下 61% 无效轨迹、误留 17% 正确轨迹。低责任场景规划占优,高责任场景验证的防误放收益主导。

2026-09-18

📚 教程中心

查看全部 →
中级

一次 getattr 绕过怎么打到 RCE:给自家 MCP Python 沙箱做一次逃逸自测

受影响组件把原始 getattr 留在内置函数白名单里,攻击者能在运行时拼出双下划线名字、沿类继承链爬到进程执行入口,让代码执行工具变成任意命令执行。本教程按范围自查、隔离复现、为何字面黑名单挡不住、版本修复与三层加固的顺序,做一次可复现的沙箱逃逸自测。

2026-09-18 · 📋 6 个步骤
部署

把 MCP 服务器收进一道网关:用 Docker Sandboxes 统一托管凭证与生命周期

与其让每个 Agent 各自配 MCP,不如在宿主机注册一次。Docker Sandboxes 的 MCP 网关把凭证与生命周期收在宿主机,沙箱内的 Agent 只见一个端点。本教程按 sbx mcp add 与 ls、静态暴露、密钥占位符与 SSRF 取舍的顺序,把这道网关跑通。

2026-09-18 · 📋 7 个步骤
高级

别再在「每次都问」和「全都放行」之间二选一:给托管智能体配一档 auto 权限

Claude 托管智能体新增 auto 权限策略:服务端按工具、参数与会话历史逐次评估,给出放行、拒绝或暂停等确认三种结论。本教程给出工具集与单工具两级的配置写法、终端接入审批的方式、审计字段的采集思路,以及上线前必须先知道的四条硬约束。

2026-09-18 · 📋 7 个步骤
中级

给智能体配一间「记忆库」:腾讯云智能体开发平台的长期记忆怎么冷启动、校准与审计

腾讯云智能体开发平台 2026 年 9 月新增记忆库:长期记忆按终端用户维度可查看、编辑、批量删除与导入导出,用来做冷启动、记忆校准与记忆审计;同一批更新还给知识库加了元数据。本教程按控制台操作顺序把这两块配齐,并标出三个生效时机的坑。

2026-09-18 · 📋 8 个步骤
高级

别再用「感觉还行」判断插件:用 claude plugin eval 量出 Skill 到底贡献多少

单看装了插件时的得分,你并不知道那是插件的功劳还是模型本来就强。claude plugin eval 会同时跑装插件与不装插件两臂并给出差值 Δ。本教程按目录结构、提示词 frontmatter、四类零成本评分器、结果表与 CI 门禁的顺序,把 Claude Code v2.1.269 起的插件评测流程走通。

2026-09-18 · 📋 7 个步骤
高级

工具调用失败别急着重试:给 Harness 加一层上下文注入式错误恢复

多数 harness 只把裸报错丢回模型,模型因此原地重试并陷入循环。上下文注入式错误恢复把错误原文、本会话历史尝试与定向恢复建议拼成结构化错误块注入下一次推理,再配合循环检测兜底。本教程给出可复现的 Python 实现,并说明四类适得其反的场景。

2026-09-17 · 📋 7 个步骤