发现最适合你的
AI 智能体与编程助手
全面收录 OpenClaw、Hermes Agent、KimiClaw、Cursor 等 206+ 款智能体 · 多维基准评测与选型指南
🦞 产品大全 共 226 款
Google Antigravity
Google Antigravity 是 Google 推出的面向 AI 智能体全生命周期开发的新一代集成开发环境,基于 VS Code 内核重构,整合了 Google 以24亿美元收购的 Windsurf 团队技术。由 Gemini 3 Pro 驱动,提供浏览器内智能体、自动化UX开发、全栈应用构建能力,Agent-First 设计理念。2026年5月19日 Google I/O 2026 发布Antigravity 2.0重大升级——从IDE转型为通用Agent优先工作平台:Manager Surface(独立面板维护持久项目上下文——架构/目标/变更历史,跨会话减少摩擦)+ Jules异步编码Agent集成(IDE内提交任务后台执行+创建PR+审查)+ Gemini 3.5 Flash支持+ 多智能体并行调度(同时部署多个子Agent分别处理不同任务)+ /schedule定时任务(一次性/周期性)+ /goal连续目标命令+ /grill-me需求澄清命令+ /browser显式浏览器调用+ 项目管理重构(workspace→project,可对应多文件夹+独立Agent设置+权限边界)+ 全新Antigravity CLI(建议Gemini CLI用户迁移,更轻量高速)+ 可本地部署SDK+ Managed Agents(1次API请求启动隔离Linux环境+持久保存,通过Gemini API接入)。
Bolt.new
StackBlitz Inc.
Bolt.new 是 StackBlitz 推出的浏览器内 AI 应用构建器(2024 年 10 月发布),通过 WebContainers 技术在浏览器中运行完整的 Node.js 环境。用户用自然语言描述想法,AI 即可生成完整的全栈 Web 应用(React/Next.js/Svelte/Astro/Vue 等多种框架)。支持实时预览、一键部署、版本历史、团队协作。Bolt V2 新增 Bolt Cloud 云端部署能力。5M+ 用户,$135M 融资。免费版可用,Pro $20/月,Pro Unlimited $100/月。与 Replit Agent、Lovable、Base44 等构成 AI App Builder 赛道核心竞争者。
Bullet
Bullet(YC S26,Adi Kulkarni & Alex Sima)
Bullet 是 Y Combinator 2026 夏季批次(YC S26)孵化的极速编程 Agent,由 Adi Kulkarni 与 Alex Sima 创立。其核心论点与主流「堆模型」路线相反:模型已经足够强,瓶颈在模型周围的「机械结构」(harness)——等待 agent 跑完的时长是开发者最大的痛点。Bullet 因此把「延迟」本身当作产品来优化,而非副作用。它不自己训练模型,而是把你已有的 Claude Code / Codex 订阅接进来(BYO 订阅,也支持 API Key 与本地模型),通过三层架构优化压缩往返次数与单任务耗时:① 智能模型路由(Smart Model Routing)——简单步骤(读文件、查路径、跑测试)路由给快模型,只有真正需要时才升级到强力模型;② 目标化代码搜索(Targeted Search)——放弃把整个仓库 embed 进上下文,改用更快的 grep 式检索拉取少数相关文件;③ 并行工具执行(Parallel Tool Execution)——独立读文件/搜索/命令并行而非串行,并拦截重复调用与卡死循环。创始人自报在 SWE-bench Verified 上单次尝试解决 479/500(95.8%)、平均 119s/任务,较 mini-SWE-agent + Fable/Sol 快 35–67%,内部测量显示往返(round-trip)减少 16%、成本降低 27%。产品以 CLI 形式通过 `npm install -g @trybullet/cli` 安装,支持 macOS 与 Linux,当前为免费私有 Beta、商业模型待定。Hacker News 社区对其核心论点(agent 已从「模型能力竞争」转向「工程效率优化」)评价正面,但也指出其差异化多为业界共识(并行工具调用、grep 优先检索、上下文卫生均非首创),真正独有且未纳入基准测试的是「逐步骤模型路由」,且封闭源码、依赖 Claude/OpenAI 订阅通道(Anthropic 已多次封禁第三方 harness 的订阅 OAuth)是增长与信任上的潜在隐患。
Claude Code
Anthropic
Claude Code 是 Anthropic 推出的 AI 编程代理(Coding Agent),可在终端、VS Code、JetBrains、桌面应用、Web 和 Slack 多种环境中运行。由 Claude Opus 5(默认 Opus 模型,1M 上下文)驱动,具备深度代码库解读、跨多文件协调编辑、Issue 自动转 PR、智能搜索等核心能力。支持 Routines 定时/触发自动化任务、Auto Mode 安全长时间运行、Fast Mode 2.5倍加速模式。支持 GitHub/GitLab/Jira/MCP 等开发工具集成。安全方面采用本地运行设计,修改文件或运行命令前需用户批准。个人版 $20/月起(年付 $17/月),Max 5x $100/月,Max 20x $200/月,企业和团队方案定制。被 Uber/Spotify/Stripe/Shopify/NASA/Figma 等知名企业广泛采用。
飞书 CodeM
字节跳动 · 飞书
飞书 CodeM 是字节跳动飞书于 2026年7月15日正式发布的原生 AI 研发智能体,面向研发团队提供覆盖协作、开发、交付全流程的自动化能力。它并非单纯提升单人编码速度,而是打通飞书项目、飞书群聊、在线文档与代码仓库,串联起团队协作、开发流程与代码运行全环节。研发团队只需下达任务指令,CodeM 即按标准化研发流程自主开展工作,依次完成开发、验证、信息同步直至交付。CodeM 支持多渠道启动:飞书私聊对话、群内 @呼叫、飞书项目 AI 节点、桌面客户端、命令行工具 CLI。依托飞书原生生态,CodeM 在群聊内 @该智能体即可启动完整需求研发流程——自动读取群聊记录、项目文档与项目信息梳理需求背景,自主完成编码、修改、验证并留存节点记录,经确认后自动上传代码,提审操作在飞书内完成,项目进度同步更新至飞书项目,全程无需跨平台跳转。CodeM 采用 Agent 执行 Daemon 架构,Agent 跑在用户本地机器,提供 Bot/CLI/桌面应用三种入口与多设备绑定;通过云端沙箱隔离执行(动态 Token 管控、用完即销)、读写与执行分级授权、数据自主可控,实现企业级安全治理。
CodeWhale(原 DeepSeek-TUI)
Hunter Bown (Hmbown)
CodeWhale(原 DeepSeek-TUI)是独立开发者 Hunter Bown 推出的终端原生 AI 编程 Agent,已于 2026 年 6 月正式更名为 CodeWhale。采用纯 Rust 编写,专为 DeepSeek V4 模型深度优化,支持 1M Token 上下文窗口,提供 Plan(只读探索)、Agent(交互审批)、YOLO(自动批准)三种工作模式。内置文件操作、Shell 执行、Git 管理、Web 搜索/浏览、子智能体、MCP 服务器等完整工具套件。支持 Windows/macOS/Linux 多平台,可通过 npm install -g codewhale 等 6 种方式安装。已获 29.3K GitHub Stars,被誉为「DeepSeek 版 Claude Code」。MIT 开源协议完全免费,仅需自备 API Key。旧名称 deepseek-tui 仍可作为兼容 shim 使用,计划在 v0.9.0 移除。
Codex CLI
OpenAI
Codex CLI 是 OpenAI 推出的本地运行AI代码智能体,2025年6月用Rust重写。不强制要求OpenAI官方账号,支持通过配置第三方模型(DeepSeek、Gemini、Ollama等)或API中转服务灵活使用。提供三种审批模式(suggest/auto-edit/full-auto),终端内即可完成代码编写、文件操作和命令执行。v0.139.0(6月9日,稳定版):网络搜索增强(代码模式直接调用独立网页搜索)+工具模式改进(保留oneOf/allOf结构,提升MCP兼容性)+诊断工具升级(codex doctor包含编辑器和分页器环境)+插件市场自动化(--json输出市场来源)+多项TUI和沙箱修复。v0.138.0(6月8日,稳定版):/app命令将CLI线程切换到Codex Desktop(macOS/原生Windows)+图片附件暴露文件路径+推理努力选择备用快捷键+插件自动化增强(--json结构化输出)+TUI性能和修复。v0.136.0(6月1日,稳定版):TUI Markdown链接支持OSC 8元数据+拥挤表格自动切换键值对格式;新增/archive命令归档会话+codex archive/unarchive命令行操作;远程执行支持CODEX_API_KEY注册+WebSocket短生命周期令牌;Windows沙箱alpha级配置(codex sandbox setup --elevated);可选原生图像生成扩展(功能门控);修复ChatGPT认证令牌刷新窗口优化+命令安全加固(防止/diff运行仓库Git钩子)+沙箱中断后清理可靠性提升。v0.135.0(5月28日,稳定版):新增 codex doctor 命令(环境/Git/终端/应用服务器/线程库存诊断)+ /status 显示远程连接详情和服务器版本 + Vim模式增强(文本对象编辑/优化单词行尾行为/配置中断轮次快捷键)+ /permissions 支持命名权限配置文件 + 打包Codex构建支持识别和启用捆绑的补丁zsh辅助工具 + Python SDK新增线程和轮次API的友好 Sandbox 预设 + install.sh/install.ps1 支持 CODE_CODEX_NON_INTERACTIVE=1 非交互安装模式;Bug修复:TUI中Markdown表格/多行列表渲染优化(列宽更合理)+ 修复macOS和Zellij下的TUI输出稳定性问题 + 斜杠命令补全保留内联参数命令的已有草稿文本 + 修复旧版tmux/iTerm控制模式会话丢失 Ctrl-C 处理 + 应用提及排除不可访问或禁用的应用;文档更新:澄清图片查看工具行为描述 + 更新Python SDK文档/示例/笔记本内容。
Cursor
Anysphere
Cursor 是 Anysphere 推出的 AI 原生 IDE,2026 年 4 月发布 Cursor 3(代号 Glass),将 AI Agent 提升到第一优先级。支持多 Agent 并行协作、Composer 2.5 自动编排(5月18日发布,10倍成本效率提升),从代码编辑器进化为智能体控制台。6月10日 Bugbot 重大升级:运行速度提升3倍(平均约5分钟→90秒)+每次运行成本降低22%+Bug发现率增加10%(0.56→0.62个/次)+支持推送前/review命令+智能PR重审(仅审查新增变更)。5月29日 v3.6 发布:Auto-Review 自动审查运行模式,允许列表内调用可立即执行、沙箱可运行调用在沙箱中执行,其余操作由分类器子智能体判断处理方式,可在设置中配置运行模式,还能为分类器智能体提供自定义指令。2026年5月20日 v3.5 发布:共享画布(Shared Canvases)让团队分享Agent创建的交互式仪表盘/报告/自定义界面,支持实时快照链接+只读Dashboard查看;Automations 自动化升级至Agent窗口,支持多代码仓库和无需仓库的自动化场景(5个新增无代码模板:Slack摘要/产品分析/产品FAQ/财务/客户健康监控)。2026年4月22日,SpaceX 旗下 SpaceXAI 与 Cursor 达成战略合作协议,获得以600亿美元全资收购的选择权,或支付100亿美元推进深度合作,双方将联合打造全球最优秀的编程与知识型AI。
豆包工作
字节跳动(ByteDance)
豆包工作(Doubao Work)是字节跳动于 2026 年 8 月 25 日正式发布的、面向生产力场景的全新 AI 办公智能体产品与品牌。它围绕用户目标自主拆解复杂任务、调用内置工具、持续推进工作流,并在获得授权后跨软件操作浏览器与电脑,长时间任务可调用云电脑继续执行、本地关机也不中断。产品与飞书深度打通,可基于企业文档、群聊、多维表格等组织上下文更准确地完成任务,自动创建任务、发私信提醒进度并将交付物回写飞书。豆包工作的界面已从对话式 AI 助手转向能承接复杂工作流的操作中台,引入框选编辑(对文档/表格/PPT 直接框选局部修改)、技能商店、连接器与工作伙伴等能力,并支持多个 Agent 组成工作小队分工协作。此前字节已将飞书产品团队(7/30)、TRAE 与扣子(Coze)团队(8/24)并入豆包体系,集中发力 AI 办公赛道。电脑版已可通过豆包官网下载,用户可在最新豆包电脑版中直接使用。
豆包工作伙伴
字节跳动 × 飞书
豆包工作伙伴是字节跳动在 2026 年 9 月 15 日「2026 飞书未来无限大会」随飞书 8.0 同步发布的国内首款团队智能体(team agent)产品。它不同于面向个人的 AI 助手,而是拥有独立身份、权限与记忆系统的「数字同事」,能够像真实员工一样被拉入飞书群聊,自动完成信息同步、文档审校、周报整理等标准化工作,并在授权范围内操作企业业务系统。飞书 8.0 本身全面向 Agent 开放数据与工具能力:开放 767 个 CLI 功能点(较 3 月上线时增加 520 个),Agent 现已具备撰写文档、操作多维表格、安排日程、参与会议等完整办公能力;多个智能体还能自主完成跨任务配合。针对企业安全管控,飞书构建了三级权限体系——Agent 权限与使用者完全一致、管理员可统一追溯使用记录、设定 AI 用量上限并管控高消耗模型场景。某汽车零部件企业试用显示,该产品使跨部门协作效率提升 40%、重复性工作减少 65%。目前处于与企业定向共创阶段,后续将逐步向客户开放。
Gemini Spark
Google(Alphabet)
Gemini Spark 是 Google 于2026年5月19日 Google I/O 2026 发布的24/7全天候个人AI Agent,定位从'你问我答'的对话式AI升级为能主动执行任务的数字伙伴。运行在Google Cloud为每个用户分配的专属VM上,不依赖用户设备——手机锁屏、笔记本关机、断网时仍然持续工作。深度集成Google Workspace(Gmail/Calendar/Drive/Docs/Sheets),所有连接默认关闭需用户主动开启。支持用自然语言下达单次或多步骤任务(Tasks)、'教'Spark学会新任务后重复执行(Skills)、设定周期性规则自动执行(Schedules)、同时处理多个任务流(多线程并行)。通过MCP协议连接第三方服务,首批合作方包括Canva/OpenTable/Instacart。涉及高风险操作时请求用户确认。任务状态和进度在所有设备上同步。目前Beta阶段,仅向美国地区Google AI Ultra订阅用户开放($100/月)。
GitHub Copilot
GitHub / Microsoft
GitHub Copilot 是 GitHub(Microsoft)推出的 AI 编程助手,1500 万+ 开发者使用,是用户量最大的 AI 编程工具。2026 年 3 月 Agent 模式在 VS Code 和 JetBrains 全面 GA,可自主规划并执行多步骤编码任务(确定修改文件、跨文件编辑、运行终端命令、检查输出并迭代)。更进一步,Coding Agent 支持将 Issue 自动分配后完成分支创建/代码编写/测试运行/PR提交的完整闭环。代码审查升级为 Agentic Architecture,可自动修复审查发现的问题。支持 Semantic Code Search 语义搜索。6 月 9 日起全面支持 Claude Fable 5 模型。6 月 1 日起转为 Premium Requests 按量计费制(Free $0/50次,Pro $10/月/300次,Pro+ $39/月/1500次,Business $19/用户/月,Enterprise $39/用户/月),超量 $0.04/次。支持 VS Code/JetBrains/Eclipse/Xcode/GitHub.com/GitHub Mobile/Windows Terminal 多平台,16 年对已认证学生/教师/开源维护者免费。
🎯 场景选型矩阵
📰 智能体资讯
查看全部 →用 Claude 黑进 OpenAI:72 小时、两个漏洞与 6500 美元赏金
华尔街日报披露,安全研究公司 Hacktron AI 的三名研究人员借 Anthropic Claude 串联两个漏洞,进入一名 OpenAI 员工的 ChatGPT 与 Codex 账户,读取内部私有代码库并提交证明访问权限的 PR,全程不到 72 小时,OpenAI 修复后支付 6500 美元赏金。AI 降低攻击门槛从口号变成实测。
2026-09-18Claude Projects 重做:每个项目配一个常驻智能体
Anthropic 重做 Claude Projects:每个项目一个常驻智能体,管理共享记忆,把复杂目标拆成并行的云端线程,合上电脑也继续干活,Boris Cherny 说他已不再手动管理会话。从会话到项目级智能体,Anthropic 在把「项目」变成统一上下文载体。
2026-09-18Google 把智能体搬进全家:CC 实验与家庭级权限的新命题
Google Labs 公开家庭智能体实验 CC:独立的云端电脑与谷歌账号,最多服务六名家庭成员,每天生成「你的一天」简报、更新日历、追任务、预填表单。它把常驻智能体从个人推进到家庭尺度,也把「谁的数据、谁可见、谁拍板」变成消费级产品必须回答的问题。
2026-09-18GLM-5.3 给自己的推理栈打工:两周、10 万张国产卡与 3.22 倍吞吐
Z.ai 公开技术文章称,GLM-5.3-Flash 的生产推理跑在超过 10 万枚国产加速器上,从跑通到生产就绪不到两周,端到端吞吐较初始基线提升至 3.22 倍,其中大量优化由 GLM-5.3 驱动的 Infra Agent 完成:人定目标与边界,智能体提假设、改内核,三层密集反馈链给出可验证的信号。
2026-09-18给智能体栈补一层操作系统:FMOS 的立场宣言
arXiv 2609.19203(ICML 2026 立场论文)认为 MCP、A2A 只解决了连接,每个框架仍在各自内嵌状态、记忆、预算与护栏的隐式运行时,行为不可移植、治理脆弱;主张用 FMOS 虚拟化层把模型交互像虚拟机抽象硬件那样抽象掉,统一编排记忆分层、模型选择、资源分配与策略执行。
2026-09-18智能体要跑得久,先得跑得稳:Temporal 5.5 亿美元 E 轮给可靠性定价
Temporal 宣布 5.5 亿美元 E 轮融资,估值 125.5 亿美元,距 2 月 D 轮 7 个月估值翻倍。这家做持久化执行的公司被 OpenAI、英伟达、Netflix、摩根大通用于生产,年化收入超 2.5 亿美元。当智能体开始接管以天计的长任务,可靠性正从工程细节变成独立的基础设施生意。
2026-09-18📚 教程中心
查看全部 →一次 getattr 绕过怎么打到 RCE:给自家 MCP Python 沙箱做一次逃逸自测
受影响组件把原始 getattr 留在内置函数白名单里,攻击者能在运行时拼出双下划线名字、沿类继承链爬到进程执行入口,让代码执行工具变成任意命令执行。本教程按范围自查、隔离复现、为何字面黑名单挡不住、版本修复与三层加固的顺序,做一次可复现的沙箱逃逸自测。
2026-09-18 · 📋 6 个步骤把 MCP 服务器收进一道网关:用 Docker Sandboxes 统一托管凭证与生命周期
与其让每个 Agent 各自配 MCP,不如在宿主机注册一次。Docker Sandboxes 的 MCP 网关把凭证与生命周期收在宿主机,沙箱内的 Agent 只见一个端点。本教程按 sbx mcp add 与 ls、静态暴露、密钥占位符与 SSRF 取舍的顺序,把这道网关跑通。
2026-09-18 · 📋 7 个步骤别再在「每次都问」和「全都放行」之间二选一:给托管智能体配一档 auto 权限
Claude 托管智能体新增 auto 权限策略:服务端按工具、参数与会话历史逐次评估,给出放行、拒绝或暂停等确认三种结论。本教程给出工具集与单工具两级的配置写法、终端接入审批的方式、审计字段的采集思路,以及上线前必须先知道的四条硬约束。
2026-09-18 · 📋 7 个步骤给智能体配一间「记忆库」:腾讯云智能体开发平台的长期记忆怎么冷启动、校准与审计
腾讯云智能体开发平台 2026 年 9 月新增记忆库:长期记忆按终端用户维度可查看、编辑、批量删除与导入导出,用来做冷启动、记忆校准与记忆审计;同一批更新还给知识库加了元数据。本教程按控制台操作顺序把这两块配齐,并标出三个生效时机的坑。
2026-09-18 · 📋 8 个步骤别再用「感觉还行」判断插件:用 claude plugin eval 量出 Skill 到底贡献多少
单看装了插件时的得分,你并不知道那是插件的功劳还是模型本来就强。claude plugin eval 会同时跑装插件与不装插件两臂并给出差值 Δ。本教程按目录结构、提示词 frontmatter、四类零成本评分器、结果表与 CI 门禁的顺序,把 Claude Code v2.1.269 起的插件评测流程走通。
2026-09-18 · 📋 7 个步骤工具调用失败别急着重试:给 Harness 加一层上下文注入式错误恢复
多数 harness 只把裸报错丢回模型,模型因此原地重试并陷入循环。上下文注入式错误恢复把错误原文、本会话历史尝试与定向恢复建议拼成结构化错误块注入下一次推理,再配合循环检测兜底。本教程给出可复现的 Python 实现,并说明四类适得其反的场景。
2026-09-17 · 📋 7 个步骤🏕️ 三大阵营
开源始祖阵营
以 OpenClaw 和 Hermes Agent 为核心,完全本地部署、数据隐私、高度可定制。AutoClaw 国产化一键安装,ClawCode Python/Rust 清洁室重写,GitHub 生态最繁荣
OpenClaw · Hermes Agent · AutoClaw · ClawCode · OpenCode大厂云端阵营
KimiClaw、ArkClaw、QClaw、MaxClaw、MaxHermes 等,依托大厂算力和模型优势,云端服务稳定可靠。Mistral Vibe 云端异步执行,Manus 通用任务自动化
KimiClaw · ArkClaw · QClaw · MaxClaw · Mistral Vibe专业工具阵营
Cursor、Windsurf、Claude Code 等,深度集成 IDE,专业开发者首选。Windsurf 内置 Devin 云端 Agent,Gemini CLI 免费百万 Token 上下文终端
Cursor · Windsurf · Gemini CLI · Claude Code · CodeArts