发现最适合你的
AI 智能体与编程助手
全面收录 OpenClaw、Hermes Agent、KimiClaw、Cursor 等 206+ 款智能体 · 多维基准评测与选型指南
🦞 产品大全 共 267 款
Google Antigravity
Google Antigravity 是 Google 推出的面向 AI 智能体全生命周期开发的新一代集成开发环境,基于 VS Code 内核重构,整合了 Google 以24亿美元收购的 Windsurf 团队技术。由 Gemini 3 Pro 驱动,提供浏览器内智能体、自动化UX开发、全栈应用构建能力,Agent-First 设计理念。2026年5月19日 Google I/O 2026 发布Antigravity 2.0重大升级——从IDE转型为通用Agent优先工作平台:Manager Surface(独立面板维护持久项目上下文——架构/目标/变更历史,跨会话减少摩擦)+ Jules异步编码Agent集成(IDE内提交任务后台执行+创建PR+审查)+ Gemini 3.5 Flash支持+ 多智能体并行调度(同时部署多个子Agent分别处理不同任务)+ /schedule定时任务(一次性/周期性)+ /goal连续目标命令+ /grill-me需求澄清命令+ /browser显式浏览器调用+ 项目管理重构(workspace→project,可对应多文件夹+独立Agent设置+权限边界)+ 全新Antigravity CLI(建议Gemini CLI用户迁移,更轻量高速)+ 可本地部署SDK+ Managed Agents(1次API请求启动隔离Linux环境+持久保存,通过Gemini API接入)。
Bolt.new
StackBlitz Inc.
Bolt.new 是 StackBlitz 推出的浏览器内 AI 应用构建器(2024 年 10 月发布),通过 WebContainers 技术在浏览器中运行完整的 Node.js 环境。用户用自然语言描述想法,AI 即可生成完整的全栈 Web 应用(React/Next.js/Svelte/Astro/Vue 等多种框架)。支持实时预览、一键部署、版本历史、团队协作。Bolt V2 新增 Bolt Cloud 云端部署能力。5M+ 用户,$135M 融资。免费版可用,Pro $20/月,Pro Unlimited $100/月。与 Replit Agent、Lovable、Base44 等构成 AI App Builder 赛道核心竞争者。
Bullet
Bullet(YC S26,Adi Kulkarni & Alex Sima)
Bullet 是 Y Combinator 2026 夏季批次(YC S26)孵化的极速编程 Agent,由 Adi Kulkarni 与 Alex Sima 创立。其核心论点与主流「堆模型」路线相反:模型已经足够强,瓶颈在模型周围的「机械结构」(harness)——等待 agent 跑完的时长是开发者最大的痛点。Bullet 因此把「延迟」本身当作产品来优化,而非副作用。它不自己训练模型,而是把你已有的 Claude Code / Codex 订阅接进来(BYO 订阅,也支持 API Key 与本地模型),通过三层架构优化压缩往返次数与单任务耗时:① 智能模型路由(Smart Model Routing)——简单步骤(读文件、查路径、跑测试)路由给快模型,只有真正需要时才升级到强力模型;② 目标化代码搜索(Targeted Search)——放弃把整个仓库 embed 进上下文,改用更快的 grep 式检索拉取少数相关文件;③ 并行工具执行(Parallel Tool Execution)——独立读文件/搜索/命令并行而非串行,并拦截重复调用与卡死循环。创始人自报在 SWE-bench Verified 上单次尝试解决 479/500(95.8%)、平均 119s/任务,较 mini-SWE-agent + Fable/Sol 快 35–67%,内部测量显示往返(round-trip)减少 16%、成本降低 27%。产品以 CLI 形式通过 `npm install -g @trybullet/cli` 安装,支持 macOS 与 Linux,当前为免费私有 Beta、商业模型待定。Hacker News 社区对其核心论点(agent 已从「模型能力竞争」转向「工程效率优化」)评价正面,但也指出其差异化多为业界共识(并行工具调用、grep 优先检索、上下文卫生均非首创),真正独有且未纳入基准测试的是「逐步骤模型路由」,且封闭源码、依赖 Claude/OpenAI 订阅通道(Anthropic 已多次封禁第三方 harness 的订阅 OAuth)是增长与信任上的潜在隐患。
Claude Code
Anthropic
Claude Code 是 Anthropic 推出的 AI 编程代理(Coding Agent),可在终端、VS Code、JetBrains、桌面应用、Web 和 Slack 多种环境中运行。由 Claude Opus 5(默认 Opus 模型,1M 上下文)驱动,具备深度代码库解读、跨多文件协调编辑、Issue 自动转 PR、智能搜索等核心能力。支持 Routines 定时/触发自动化任务、Auto Mode 安全长时间运行、Fast Mode 2.5倍加速模式。支持 GitHub/GitLab/Jira/MCP 等开发工具集成。安全方面采用本地运行设计,修改文件或运行命令前需用户批准。个人版 $20/月起(年付 $17/月),Max 5x $100/月,Max 20x $200/月,企业和团队方案定制。被 Uber/Spotify/Stripe/Shopify/NASA/Figma 等知名企业广泛采用。
飞书 CodeM
字节跳动 · 飞书
飞书 CodeM 是字节跳动飞书于 2026年7月15日正式发布的原生 AI 研发智能体,面向研发团队提供覆盖协作、开发、交付全流程的自动化能力。它并非单纯提升单人编码速度,而是打通飞书项目、飞书群聊、在线文档与代码仓库,串联起团队协作、开发流程与代码运行全环节。研发团队只需下达任务指令,CodeM 即按标准化研发流程自主开展工作,依次完成开发、验证、信息同步直至交付。CodeM 支持多渠道启动:飞书私聊对话、群内 @呼叫、飞书项目 AI 节点、桌面客户端、命令行工具 CLI。依托飞书原生生态,CodeM 在群聊内 @该智能体即可启动完整需求研发流程——自动读取群聊记录、项目文档与项目信息梳理需求背景,自主完成编码、修改、验证并留存节点记录,经确认后自动上传代码,提审操作在飞书内完成,项目进度同步更新至飞书项目,全程无需跨平台跳转。CodeM 采用 Agent 执行 Daemon 架构,Agent 跑在用户本地机器,提供 Bot/CLI/桌面应用三种入口与多设备绑定;通过云端沙箱隔离执行(动态 Token 管控、用完即销)、读写与执行分级授权、数据自主可控,实现企业级安全治理。
CodeWhale(原 DeepSeek-TUI)
Hunter Bown (Hmbown)
CodeWhale(原 DeepSeek-TUI)是独立开发者 Hunter Bown 推出的终端原生 AI 编程 Agent,已于 2026 年 6 月正式更名为 CodeWhale。采用纯 Rust 编写,专为 DeepSeek V4 模型深度优化,支持 1M Token 上下文窗口,提供 Plan(只读探索)、Agent(交互审批)、YOLO(自动批准)三种工作模式。内置文件操作、Shell 执行、Git 管理、Web 搜索/浏览、子智能体、MCP 服务器等完整工具套件。支持 Windows/macOS/Linux 多平台,可通过 npm install -g codewhale 等 6 种方式安装。已获 29.3K GitHub Stars,被誉为「DeepSeek 版 Claude Code」。MIT 开源协议完全免费,仅需自备 API Key。旧名称 deepseek-tui 仍可作为兼容 shim 使用,计划在 v0.9.0 移除。
Codex CLI
OpenAI
Codex CLI 是 OpenAI 推出的本地运行AI代码智能体,2025年6月用Rust重写。不强制要求OpenAI官方账号,支持通过配置第三方模型(DeepSeek、Gemini、Ollama等)或API中转服务灵活使用。提供三种审批模式(suggest/auto-edit/full-auto),终端内即可完成代码编写、文件操作和命令执行。v0.139.0(6月9日,稳定版):网络搜索增强(代码模式直接调用独立网页搜索)+工具模式改进(保留oneOf/allOf结构,提升MCP兼容性)+诊断工具升级(codex doctor包含编辑器和分页器环境)+插件市场自动化(--json输出市场来源)+多项TUI和沙箱修复。v0.138.0(6月8日,稳定版):/app命令将CLI线程切换到Codex Desktop(macOS/原生Windows)+图片附件暴露文件路径+推理努力选择备用快捷键+插件自动化增强(--json结构化输出)+TUI性能和修复。v0.136.0(6月1日,稳定版):TUI Markdown链接支持OSC 8元数据+拥挤表格自动切换键值对格式;新增/archive命令归档会话+codex archive/unarchive命令行操作;远程执行支持CODEX_API_KEY注册+WebSocket短生命周期令牌;Windows沙箱alpha级配置(codex sandbox setup --elevated);可选原生图像生成扩展(功能门控);修复ChatGPT认证令牌刷新窗口优化+命令安全加固(防止/diff运行仓库Git钩子)+沙箱中断后清理可靠性提升。v0.135.0(5月28日,稳定版):新增 codex doctor 命令(环境/Git/终端/应用服务器/线程库存诊断)+ /status 显示远程连接详情和服务器版本 + Vim模式增强(文本对象编辑/优化单词行尾行为/配置中断轮次快捷键)+ /permissions 支持命名权限配置文件 + 打包Codex构建支持识别和启用捆绑的补丁zsh辅助工具 + Python SDK新增线程和轮次API的友好 Sandbox 预设 + install.sh/install.ps1 支持 CODE_CODEX_NON_INTERACTIVE=1 非交互安装模式;Bug修复:TUI中Markdown表格/多行列表渲染优化(列宽更合理)+ 修复macOS和Zellij下的TUI输出稳定性问题 + 斜杠命令补全保留内联参数命令的已有草稿文本 + 修复旧版tmux/iTerm控制模式会话丢失 Ctrl-C 处理 + 应用提及排除不可访问或禁用的应用;文档更新:澄清图片查看工具行为描述 + 更新Python SDK文档/示例/笔记本内容。
Cursor
Anysphere
Cursor 是 Anysphere 推出的 AI 原生 IDE,2026 年 4 月发布 Cursor 3(代号 Glass),将 AI Agent 提升到第一优先级。支持多 Agent 并行协作、Composer 2.5 自动编排(5月18日发布,10倍成本效率提升),从代码编辑器进化为智能体控制台。6月10日 Bugbot 重大升级:运行速度提升3倍(平均约5分钟→90秒)+每次运行成本降低22%+Bug发现率增加10%(0.56→0.62个/次)+支持推送前/review命令+智能PR重审(仅审查新增变更)。5月29日 v3.6 发布:Auto-Review 自动审查运行模式,允许列表内调用可立即执行、沙箱可运行调用在沙箱中执行,其余操作由分类器子智能体判断处理方式,可在设置中配置运行模式,还能为分类器智能体提供自定义指令。2026年5月20日 v3.5 发布:共享画布(Shared Canvases)让团队分享Agent创建的交互式仪表盘/报告/自定义界面,支持实时快照链接+只读Dashboard查看;Automations 自动化升级至Agent窗口,支持多代码仓库和无需仓库的自动化场景(5个新增无代码模板:Slack摘要/产品分析/产品FAQ/财务/客户健康监控)。2026年4月22日,SpaceX 旗下 SpaceXAI 与 Cursor 达成战略合作协议,获得以600亿美元全资收购的选择权,或支付100亿美元推进深度合作,双方将联合打造全球最优秀的编程与知识型AI。
豆包工作
字节跳动(ByteDance)
豆包工作(Doubao Work)是字节跳动于 2026 年 8 月 25 日正式发布的、面向生产力场景的全新 AI 办公智能体产品与品牌。它围绕用户目标自主拆解复杂任务、调用内置工具、持续推进工作流,并在获得授权后跨软件操作浏览器与电脑,长时间任务可调用云电脑继续执行、本地关机也不中断。产品与飞书深度打通,可基于企业文档、群聊、多维表格等组织上下文更准确地完成任务,自动创建任务、发私信提醒进度并将交付物回写飞书。豆包工作的界面已从对话式 AI 助手转向能承接复杂工作流的操作中台,引入框选编辑(对文档/表格/PPT 直接框选局部修改)、技能商店、连接器与工作伙伴等能力,并支持多个 Agent 组成工作小队分工协作。此前字节已将飞书产品团队(7/30)、TRAE 与扣子(Coze)团队(8/24)并入豆包体系,集中发力 AI 办公赛道。电脑版已可通过豆包官网下载,用户可在最新豆包电脑版中直接使用。
豆包工作伙伴
字节跳动 × 飞书
豆包工作伙伴是字节跳动在 2026 年 9 月 15 日「2026 飞书未来无限大会」随飞书 8.0 同步发布的国内首款团队智能体(team agent)产品。它不同于面向个人的 AI 助手,而是拥有独立身份、权限与记忆系统的「数字同事」,能够像真实员工一样被拉入飞书群聊,自动完成信息同步、文档审校、周报整理等标准化工作,并在授权范围内操作企业业务系统。飞书 8.0 本身全面向 Agent 开放数据与工具能力:开放 767 个 CLI 功能点(较 3 月上线时增加 520 个),Agent 现已具备撰写文档、操作多维表格、安排日程、参与会议等完整办公能力;多个智能体还能自主完成跨任务配合。针对企业安全管控,飞书构建了三级权限体系——Agent 权限与使用者完全一致、管理员可统一追溯使用记录、设定 AI 用量上限并管控高消耗模型场景。某汽车零部件企业试用显示,该产品使跨部门协作效率提升 40%、重复性工作减少 65%。目前处于与企业定向共创阶段,后续将逐步向客户开放。
Gemini Spark
Google(Alphabet)
Gemini Spark 是 Google 于2026年5月19日 Google I/O 2026 发布的24/7全天候个人AI Agent,定位从'你问我答'的对话式AI升级为能主动执行任务的数字伙伴。运行在Google Cloud为每个用户分配的专属VM上,不依赖用户设备——手机锁屏、笔记本关机、断网时仍然持续工作。深度集成Google Workspace(Gmail/Calendar/Drive/Docs/Sheets),所有连接默认关闭需用户主动开启。支持用自然语言下达单次或多步骤任务(Tasks)、'教'Spark学会新任务后重复执行(Skills)、设定周期性规则自动执行(Schedules)、同时处理多个任务流(多线程并行)。通过MCP协议连接第三方服务,首批合作方包括Canva/OpenTable/Instacart。涉及高风险操作时请求用户确认。任务状态和进度在所有设备上同步。目前Beta阶段,仅向美国地区Google AI Ultra订阅用户开放($100/月)。
GitHub Copilot
GitHub / Microsoft
GitHub Copilot 是 GitHub(Microsoft)推出的 AI 编程助手,1500 万+ 开发者使用,是用户量最大的 AI 编程工具。2026 年 3 月 Agent 模式在 VS Code 和 JetBrains 全面 GA,可自主规划并执行多步骤编码任务(确定修改文件、跨文件编辑、运行终端命令、检查输出并迭代)。更进一步,Coding Agent 支持将 Issue 自动分配后完成分支创建/代码编写/测试运行/PR提交的完整闭环。代码审查升级为 Agentic Architecture,可自动修复审查发现的问题。支持 Semantic Code Search 语义搜索。6 月 9 日起全面支持 Claude Fable 5 模型。6 月 1 日起转为 Premium Requests 按量计费制(Free $0/50次,Pro $10/月/300次,Pro+ $39/月/1500次,Business $19/用户/月,Enterprise $39/用户/月),超量 $0.04/次。支持 VS Code/JetBrains/Eclipse/Xcode/GitHub.com/GitHub Mobile/Windows Terminal 多平台,16 年对已认证学生/教师/开源维护者免费。
🎯 场景选型矩阵
📰 智能体资讯
查看全部 →同周三家的发布,把智能体可观测推成规模化落地的关键基础设施
9 月 21 日腾讯云 Agent 可观测服务上线、9 月 22 日 AWS CloudWatch Omni 与 OpenObserve v1.0 同日 GA,三家把 Agent 全链路追踪、评估与持续优化放进同一平面。智能体从实验室进生产,黑盒四痛点正被当成一类独立基础设施来补。
2026-09-25发现漏洞不等于能打:KEX-bench 测出编程智能体生成内核利用原语的鸿沟
9 月 22 日,KEX-bench(arXiv 2609.25591)发布:在隔离虚拟机里用 45 个任务覆盖 40 个 Linux 与 Windows CVE,评测编程智能体生成漏洞利用原语。表现最好的配置无参考 PoC 仅解 1/20 Windows、14/25 Linux,有 PoC 也只到 68.9%。
2026-09-25医疗前台这个最容易被低估的复杂场景:Assort Health 用专科决策树把语音智能体做到 1300 家机构
9 月 24 日,医疗语音智能体 Assort Health 宣布接入超 1300 家医疗机构,95% 无需转人工的患者交互由其解决。其差异在按 23 个以上专科分别调优的呼叫逻辑与 Patient Journey Memory,把接电话做成可治理、可回溯的临床入口。
2026-09-25从帮你找展商到替你做生意:Accio 数贸会agent 把 AI 带进真实贸易现场
9 月 24 日,阿里国际站 Accio 与数贸会联合推出数贸会agent:对话即可路线规划、展商匹配、拍照找厂、日程查询。Accio 已服务超 1000 万中小外贸企业,智能体拆解经营目标、调用不同专业 Agent 协同执行,把 AI 从信息生成推向任务交付。
2026-09-25走出对话窗口:AutoCore AutoForge 桌面端让多智能体坐到工程师身边
9 月 24 日,AutoCore 发布 AutoForge 桌面端:云端 SaaS 上验证过的各领域 AI 专家智能体,直接进驻研发人员本地工作站,围绕一套单一、动态、一致的系统工程模型并行协作,并连接 CANoe、Simulink 等车载工具链。
2026-09-25税务合规巨头的 agentic 转身:Avalara 用四个专用智能体把企业集成从数周压到数天
9 月 24 日,税务合规服务商 Avalara 推出 Versori by Avalara:由四个专用智能体跑通 plan、connect、build、deploy 全生命周期,把企业系统接入其税控与合规方案的周期从数周工程压到数天,连接层正成为智能体落地的下一处战场。
2026-09-25📚 教程中心
查看全部 →用 Cloudflare Vectorize 做无服务器向量检索与 RAG(Workers AI 嵌入 + D1 存原文)
Cloudflare Vectorize 无服务器向量检索与 RAG 实操:wrangler 建索引、Workers AI 生成嵌入、D1 存原文,query 取 topK 相似向量后拼上下文调 LLM 生成答案,含维度定死与计费注意。
2026-09-24 · 📋 6 个步骤用 MCP Sampling 让 Server 反向调用大模型(sampling/createMessage 实操)
MCP Sampling 实操:用官方 mcp 包的 FastMCP 写会调用 ctx.session.create_message 的服务器,配带 sampling_callback 的客户端,跑通 sampling/createMessage 反向请求宿主模型,并说明弃用状态与安全边界。
2026-09-24 · 📋 5 个步骤用 LiveKit Agents 搭可打断的语音智能体(STT→LLM→TTS 流水线)
LiveKit Agents 开源实时语音智能体框架实操:装依赖、配密钥,用 AgentSession 串起 STT→LLM→TTS 流水线,打开 allow_interruptions 实现自然打断,并用 function_tool 让语音 Agent 中途调用工具。
2026-09-24 · 📋 6 个步骤自建 Agent 会话回放器:结构化事件日志,坏步骤事后可查
不依赖 Langfuse 等平台:把 Agent 运行记成 JSONL 事件流(llm_call / tool_call / tool_result),~150 行代码实现时间线回放、错误过滤、耗时定位,以及从任意断点重建上下文继续调试。
2026-09-23 · 📋 7 个步骤工具结果缓存与幂等设计:让 Agent 重试不重复执行、不重复计费
参数哈希做缓存键 + SQLite 持久缓存 + TTL 与负缓存 + 写操作幂等键登记表。解决 Agent 重试风暴下的三类浪费:重复计算、重复调用计费、重复写入副作用。
2026-09-23 · 📋 7 个步骤Agent 并发工具调用工程:Semaphore 限流、结果聚合与部分失败处理
把串行 20 次搜索从 40 秒压到 4 秒:asyncio.gather 并发、Semaphore 设并发上限、令牌桶控速率、聚合时区分成败。与容错三板斧(463)互补,一篇解决 Agent 批量调工具的吞吐问题。
2026-09-23 · 📋 7 个步骤🏕️ 三大阵营
开源始祖阵营
以 OpenClaw 和 Hermes Agent 为核心,完全本地部署、数据隐私、高度可定制。AutoClaw 国产化一键安装,ClawCode Python/Rust 清洁室重写,GitHub 生态最繁荣
OpenClaw · Hermes Agent · AutoClaw · ClawCode · OpenCode大厂云端阵营
KimiClaw、ArkClaw、QClaw、MaxClaw、MaxHermes 等,依托大厂算力和模型优势,云端服务稳定可靠。Mistral Vibe 云端异步执行,Manus 通用任务自动化
KimiClaw · ArkClaw · QClaw · MaxClaw · Mistral Vibe专业工具阵营
Cursor、Windsurf、Claude Code 等,深度集成 IDE,专业开发者首选。Windsurf 内置 Devin 云端 Agent,Gemini CLI 免费百万 Token 上下文终端
Cursor · Windsurf · Gemini CLI · Claude Code · CodeArts