📖 Agent 百科

AI Agent 领域最权威的知识库 — 从基础概念到前沿技术
每个条目都经过严谨校对,帮你建立完整的 Agent 知识体系

100 个条目 · 7 个分类 · 持续更新中
支持按标题、别名、摘要、标签搜索 · 输入关键词实时筛选
基础概念 ⏱️ 25分钟

AI Agent(人工智能体)

别名:智能体 · AI智能体 · 自主智能体

AI Agent(人工智能体)是能够自主感知环境、制定计划并使用工具完成目标的智能系统,是 2026 年 AI 产业最核心的应用形态。

阅读全文 →
Agent 的核心特征是自主性(Autonomy…
基础概念 ⏱️ 19分钟

LLM(大语言模型)

别名:大模型 · 大语言模型 · Large Language Model

大语言模型(LLM)是以 Transformer 架构为核心的深度学习模型,经过海量文本训练,具备语言理解、生成和推理能力,是 AI Agent 的智能核心。

阅读全文 →
现代 LLM 均基于 Transformer 架…
基础概念 ⏱️ 19分钟

RAG(检索增强生成)

别名:检索增强生成 · Retrieval-Augmented Generation · RAG

RAG(检索增强生成)通过将外部知识检索与 LLM 生成相结合,显著提升了 AI Agent 回答的准确性和时效性,是减少幻觉的标准化方案。

阅读全文 →
RAG 三阶段流程:检索(Retrieve)→ …
基础概念 ⏱️ 16分钟

Function Calling(函数调用)

别名:工具调用 · 函数调用 · Tool Calling

Function Calling 使 LLM 能够通过结构化输出来调用外部函数和 API,是 AI Agent 与现实世界交互的核心机制。

阅读全文 →
主流 LLM 均原生支持 Function Ca…
基础概念 ⏱️ 19分钟

Tool Use(工具使用)

别名:工具使用 · Tool Utilization · 工具学习

Tool Use 使 AI Agent 能突破纯语言模型的局限,调用外部工具执行真实操作,是 Agent 区别于聊天机器人的核心能力。

阅读全文 →
生产级 Agent 平均集成 7.3 个工具,涵…
基础概念 ⏱️ 19分钟

Prompt Engineering(提示工程)

别名:提示工程 · Prompt设计 · 指令工程

Prompt Engineering 是设计和优化 AI 提示词的系统工程,在 Agent 场景中直接决定了 Agent 的行为质量和安全性。

阅读全文 →
System Prompt 是 Agent 的行…
基础概念 ⏱️ 19分钟

Chain of Thought(思维链)

别名:思维链 · CoT · Chain-of-Thought

Chain of Thought 通过引导模型显式展示推理步骤来提升复杂任务的解决能力,是现代 AI Agent 推理能力的基础技术之一。

阅读全文 →
CoT 能显著提升 LLM 在数学、逻辑和多步骤…
基础概念 ⏱️ 19分钟

Vibe Coding(氛围编程)

别名:氛围编程 · 自然语言编程 · AI编程

Vibe Coding 是用自然语言描述编程需求、由 AI 自动生成代码的新型编程范式,正在重新定义软件开发者的角色和流程。

阅读全文 →
Vibe Coding 已从概念走向实践,202…
技术协议 ⏱️ 22分钟

MCP(Model Context Protocol)

别名:模型上下文协议 · MCP协议 · Model Context Protocol

MCP 是 AI Agent 与外部工具之间的标准化通信协议,被誉为「AI 世界的 USB 接口」,是 2026 年 Agent 生态最重要的基础协议。

阅读全文 →
MCP 三大原语:Tools(可调用函数)、Re…
技术协议 ⏱️ 19分钟

A2A(Agent-to-Agent Protocol)

别名:智能体间协议 · Agent通信协议 · Agent-to-Agent

A2A 是 Google 推出的 Agent 间通信开放协议,使不同厂商的 AI Agent 能够相互发现、协商和协作,与 MCP 构成 Agent 通信协议栈的上下两层。

阅读全文 →
A2A 采用三层角色模型:Client Agen…
技术协议 ⏱️ 16分钟

Agent Card(智能体能力卡)

别名:智能体能力卡 · Agent Card · 能力声明

Agent Card 是智能体的标准化能力声明文档,使 Agent 能够被其他 Agent 和系统自动发现和调用。

阅读全文 →
Agent Card 包含:能力描述、端点 UR…
技术协议 ⏱️ 16分钟

SSE(Server-Sent Events)

别名:服务端推送 · Server-Sent Events · SSE

SSE 是一种轻量级服务器推送技术,在 AI Agent 生态中广泛用于实时状态传输和流式结果返回。

阅读全文 →
SSE 基于 HTTP 长连接,比 WebSoc…
架构范式 ⏱️ 19分钟

Single Agent(单智能体架构)

别名:单Agent架构 · 单体Agent · Single Agent

单智能体架构是最基础的 Agent 设计模式,一个 Agent 独立完成所有工作,适合简单任务和个人使用场景。

阅读全文 →
单 Agent 架构的优势在于简单、易于调试和维…
架构范式 ⏱️ 19分钟

Multi-Agent System(多智能体系统)

别名:多Agent系统 · MAS · 多智能体

多智能体系统通过多个专业化 Agent 的协作实现复杂任务,是 2026 年企业级 Agent 部署的主流架构选择。

阅读全文 →
2026 Q1 新部署的 Agent 中 45%…
架构范式 ⏱️ 19分钟

Agent Swarm(智能体群)

别名:智能体群 · Agent Swarm · 群智能

Agent Swarm 是去中心化的多智能体群体架构,通过 Agent 间的局部交互涌现出全局智能行为,适用于复杂协作场景。

阅读全文 →
Swarm 的核心特征是去中心化:没有编排器,A…
架构范式 ⏱️ 16分钟

Agentic RAG(智能体增强检索)

别名:智能体RAG · Agentic RAG · 自主RAG

Agentic RAG 将 Agent 的自主决策能力融入检索增强生成流程,支持多轮检索和自适应策略,是企业级知识问答场景的主流架构。

阅读全文 →
Agentic RAG 的核心是「检索即行动」:…
架构范式 ⏱️ 16分钟

ReAct Pattern(推理-行动模式)

别名:推理行动模式 · ReAct · Reasoning-Acting

ReAct 模式将推理和行动紧密交织,Agent 每步先思考再行动,是现代 AI Agent 最基础的工作循环模式。

阅读全文 →
ReAct 循环:Thought(推理)→ Ac…
安全风险 ⏱️ 19分钟

Prompt Injection(提示注入攻击)

别名:提示注入 · 提示攻击 · 注入攻击

Prompt Injection 是 AI Agent 领域最严重的安全威胁,攻击者通过构造特殊输入劫持模型行为,属于 OWASP Top 10 中风险等级最高的问题。

阅读全文 →
Prompt Injection 是 OWASP…
安全风险 ⏱️ 16分钟

OWASP Top 10 for LLM Applications

别名:OWASP Top 10 · LLM安全 · OWASP LLM

OWASP Top 10 for LLM Applications 是 LLM 和 Agent 安全领域的权威风险排行榜,2026 年版本新增了 Agent 特有的安全风险分类。

阅读全文 →
OWASP 2026 Agentic AI To…
安全风险 ⏱️ 19分钟

Agent Memory Poisoning(记忆投毒)

别名:记忆投毒 · Agent记忆攻击 · 记忆污染

Agent Memory Poisoning 是 2026 年最具破坏力的 Agent 安全威胁之一,攻击者通过污染 Agent 的记忆系统实现隐蔽且持久的恶意操控。

阅读全文 →
94% 的生产级 Agent 可被记忆投毒攻击(…
安全风险 ⏱️ 16分钟

Tool Chain Attack(工具链攻击)

别名:工具链攻击 · 工具投毒 · 供应链攻击

Tool Chain Attack 利用 Agent 对外部工具的信任,通过供应链投毒或中间人攻击来间接操控 Agent 行为,是 2026 年最危险的 Agent 攻击面之一。

阅读全文 →
91% 的生产级 Agent 存在工具链攻击漏洞…
评测基准 ⏱️ 19分钟

SWE-bench(软件工程基准)

别名:SWE-bench · 软件工程基准 · AI编码评测

SWE-bench 是评估 AI 编程 Agent 能力的权威基准测试,通过真实 GitHub Issue 修复任务来量化 Agent 的编码能力。

阅读全文 →
SWE-bench Verified 是官方验证…
评测基准 ⏱️ 16分钟

GAIA(通用AI助手基准)

别名:GAIA · 通用AI基准 · AI助手评测

GAIA 是 Meta 设计的通用 AI 助手评测基准,通过需多步推理和工具使用的真实世界问题来衡量 AI Agent 的综合能力。

阅读全文 →
GAIA 的题目需要多步推理 + 工具使用 + …
评测基准 ⏱️ 16分钟

HumanEval(代码生成基准)

别名:HumanEval · 代码生成评测 · 函数级编码

HumanEval 是 OpenAI 发布的函数级代码生成基准,曾是最主流的 AI 编程能力评测标准,但 2026 年已接近饱和。

阅读全文 →
HumanEval 是目前引用最广泛的代码生成基…
框架工具 ⏱️ 19分钟

LangChain(语言链框架)

别名:LangChain · 语言链 · LLM框架

LangChain 是最广泛使用的 LLM 应用开发框架,提供从模型调用到 Agent 编排的全栈工具链。

阅读全文 →
LangChain 的核心是 Chain(链)抽…
框架工具 ⏱️ 16分钟

CrewAI(多智能体协作框架)

别名:CrewAI · 多Agent协作 · Agent团队

CrewAI 是专为多智能体团队协作设计的 Python 框架,通过角色化的 Agent 和任务分配机制实现高效的 Agent 团队协作。

阅读全文 →
CrewAI 的核心概念:Agent(角色)、T…
框架工具 ⏱️ 16分钟

AutoGPT(自主GPT)

别名:AutoGPT · 自主GPT · 自主Agent

AutoGPT 是首个开源自主 AI Agent 项目,开创了「LLM 自主设定和执行子目标」的范式,对后续 Agent 产品产生了深远影响。

阅读全文 →
AutoGPT 是 2023 年 AI Agen…
框架工具 ⏱️ 16分钟

LangGraph(Agent 编排引擎)

别名:LangGraph · Agent编排 · 状态图

LangGraph 是基于图结构的 Agent 编排框架,通过状态图建模 Agent 的动态决策流程,是构建生产级复杂 Agent 的核心工具。

阅读全文 →
LangGraph 将 Agent 流程建模为有…
行业生态 ⏱️ 16分钟

Agent Store(智能体商店)

别名:智能体商店 · Agent商店 · Agent市场

Agent Store 是 AI Agent 的分发和交易平台,类似 App Store 但面向 AI Agent,是 2026 年 AI 经济的重要基础设施。

阅读全文 →
OpenClaw Registry 是 2026…
行业生态 ⏱️ 16分钟

MCP Marketplace(MCP 市场)

别名:MCP市场 · MCP商店 · 工具市场

MCP Marketplace 是 MCP 协议生态中工具 Server 的分发平台,开发者可发布工具、用户可扩展 Agent 能力,是 Agent 生态的关键基础设施。

阅读全文 →
MCP Marketplace 已有 1000+…
行业生态 ⏱️ 16分钟

Agentic AI(智能体 AI)

别名:智能体AI · Agentic时代 · AI Agent化

Agentic AI 代表 AI 从被动工具到主动代理的根本性范式转变,是 2026 年 AI 产业最核心的趋势,正在重新定义人与 AI 的协作方式。

阅读全文 →
Agentic AI 的三要素:自主决策(Aut…
基础概念 ⏱️ 16分钟

Embedding(嵌入与向量化)

别名:嵌入 · 向量嵌入 · 文本嵌入

Embedding 技术将非结构化数据转换为语义向量,是 RAG 系统和 Agent 记忆系统的核心基础设施。

阅读全文 →
Embedding 将文本转换为固定长度的向量,…
基础概念 ⏱️ 18分钟

Multimodal AI(多模态 AI)

别名:多模态AI · 多模态模型 · 视觉语言模型

多模态 AI 使 Agent 能理解和处理图像、音频、视频等多种输入,大幅扩展了 Agent 的感知范围和应用场景。

阅读全文 →
2026 年所有主流 LLM(GPT-4o、Cl…
基础概念 ⏱️ 18分钟

Reasoning Model(推理模型)

别名:推理模型 · 思考模型 · 深度推理

推理模型通过延长内部思考时间来提升复杂任务的解决能力,是 2026 年 AI Agent 处理高难度问题的核心引擎。

阅读全文 →
OpenAI o1(2024.09)是首个推理模…
基础概念 ⏱️ 16分钟

Fine-Tuning(微调)

别名:微调 · 模型微调 · 指令微调

微调是在预训练模型基础上进行额外训练以定制化 Agent 行为的技术,是深度优化 Agent 领域能力的核心手段。

阅读全文 →
LoRA(Low-Rank Adaptation…
基础概念 ⏱️ 15分钟

Knowledge Distillation(知识蒸馏)

别名:知识蒸馏 · 模型蒸馏 · 蒸馏

知识蒸馏通过大型模型「教」小型模型的方式来降低 AI Agent 的运行成本,是 2026 年 Agent 经济性的关键技术之一。

阅读全文 →
蒸馏后的模型体积减少 50-90%,推理速度提升…
基础概念 ⏱️ 16分钟

Token Economics(Token 经济学)

别名:Token经济学 · AI成本 · 推理成本

Token 经济学研究 AI Agent 的运行成本,2026 年推理成本的 128 倍下降是 Agent 产业化的经济性拐点。

阅读全文 →
2026 年 GPT-4 级别的推理成本已从 2…
技术协议 ⏱️ 14分钟

Streamable HTTP(流式 HTTP)

别名:流式HTTP · Streamable HTTP · MCP传输

Streamable HTTP 是 MCP 协议的新一代远程传输方式,基于标准 HTTP 协议实现 Agent 与工具 Server 之间的高效通信。

阅读全文 →
Streamable HTTP 是 MCP 20…
技术协议 ⏱️ 16分钟

OpenAI API(OpenAI 接口协议)

别名:OpenAI API · GPT API · Chat Completions

OpenAI API 是调用 GPT 系列模型构建 AI Agent 的标准接口,其设计理念和接口规范已成为整个 AI 行业的参考标准。

阅读全文 →
Chat Completions API 是最广…
技术协议 ⏱️ 16分钟

MCP Security(MCP 安全机制)

别名:MCP安全 · MCP认证 · MCP授权

MCP Security 是 MCP 协议的安全机制集合,涵盖认证、授权、审计和数据保护,是 MCP 生态从开放走向可靠的关键。

阅读全文 →
MCP 2026 版本引入了 OAuth 2.0…
架构范式 ⏱️ 16分钟

Plan-and-Execute(规划-执行架构)

别名:规划执行 · Plan-then-Execute · 先规划后执行

Plan-and-Execute 先制定详细计划再逐步执行的 Agent 架构模式,适合需要人类审批和长时间运行的企业级复杂任务。

阅读全文 →
Plan-and-Execute 与 ReAct…
架构范式 ⏱️ 16分钟

Supervisor Pattern(监督者模式)

别名:监督模式 · Supervisor · 管理者Agent

Supervisor Pattern 通过一个监督者 Agent 集中协调多个专业子 Agent 的协作,是 2026 年最主流的可生产化多智能体架构。

阅读全文 →
Supervisor 是 2026 年生产环境中…
架构范式 ⏱️ 15分钟

Reflection Pattern(反思模式)

别名:反思模式 · 自省模式 · Self-Reflection

Reflection Pattern 让 Agent 对自身输出进行自我审查和改进,是提升 AI Agent 输出质量和可靠性的关键架构模式。

阅读全文 →
Reflection Pattern 在 Cod…
安全风险 ⏱️ 16分钟

Agent Data Privacy(Agent 数据隐私)

别名:数据隐私 · Agent隐私 · 数据保护

Agent 数据隐私涉及 Agent 收集、处理和保护用户数据的全生命周期,是 2026 年企业部署 Agent 的首要合规考量。

阅读全文 →
2026 年 72% 的企业将 Agent 数据…
安全风险 ⏱️ 16分钟

Agent Access Control(Agent 访问控制)

别名:访问控制 · 权限管理 · Agent权限

Agent 访问控制通过最小权限原则确保 Agent 只能访问完成任务所必需的资源,是 Agent 安全防护的第一道防线。

阅读全文 →
最小权限原则(Least Privilege)是…
安全风险 ⏱️ 16分钟

Agent Supply Chain Security(Agent 供应链安全)

别名:供应链安全 · Agent供应链 · 第三方风险

Agent 供应链安全管理 Agent 生态中第三方组件(LLM、MCP Server、框架)的风险,是 2026 年 Agent 安全最复杂的新领域。

阅读全文 →
Agent 供应链比传统软件供应链风险面更广:L…
评测基准 ⏱️ 15分钟

MMLU(大规模多任务语言理解)

别名:MMLU · Massive Multitask Language Understanding · 多任务理解

MMLU 是覆盖 57 个学科的大规模知识评测基准,曾是 LLM 最权威的评测标准,2026 年已接近饱和。

阅读全文 →
MMLU 包含 15908 道选择题,覆盖 57…
评测基准 ⏱️ 14分钟

LiveBench(实时基准评测)

别名:LiveBench · 实时评测 · 动态基准

LiveBench 通过每月更新的动态题库解决数据污染问题,是 2026 年最受认可的实时 LLM 能力评测基准。

阅读全文 →
LiveBench 每月更新题库,有效防止训练数…
评测基准 ⏱️ 15分钟

Chatbot Arena(聊天机器人竞技场)

别名:Chatbot Arena · LMSYS Arena · ELO评分

Chatbot Arena 通过人类匿名对战投票生成 ELO 评分,是最能反映真实用户体验的 AI 能力评测平台。

阅读全文 →
Chatbot Arena 是最权威的人类偏好评…
框架工具 ⏱️ 16分钟

OpenAI Agents SDK(OpenAI 智能体 SDK)

别名:OpenAI Agents SDK · OpenAI Agent框架 · Agents SDK

OpenAI Agents SDK 是 OpenAI 官方推出的 Agent 开发框架,提供从单 Agent 到多 Agent 协作的一站式构建能力。

阅读全文 →
OpenAI Agents SDK 提供 Age…
框架工具 ⏱️ 15分钟

LlamaIndex(数据索引框架)

别名:LlamaIndex · 数据框架 · GPT Index

LlamaIndex 是连接 LLM 与外部数据的专业框架,提供从数据摄取到检索的全链路能力,是构建 RAG 和知识库 Agent 的首选工具。

阅读全文 →
LlamaIndex 提供 150+ 数据连接器…
框架工具 ⏱️ 15分钟

Google ADK(Agent Development Kit)

别名:Google ADK · Agent开发工具包 · Google Agent框架

Google ADK 是 Google 官方 Agent 开发工具包,深度集成 Gemini 模型和 Google 服务生态,原生支持 A2A 多 Agent 通信协议。

阅读全文 →
Google ADK 是 Google 于 20…
行业生态 ⏱️ 18分钟

AI Agent Regulation(AI Agent 监管)

别名:AI监管 · Agent监管 · AI法规

全球 AI Agent 监管正在快速跟进技术发展,欧盟、中国、美国各自推出了针对 AI Agent 的立法和监管框架。

阅读全文 →
欧盟 AI Act(2026 全面实施)将 Ag…
行业生态 ⏱️ 15分钟

Agent Pricing Model(Agent 定价模式)

别名:定价模式 · Agent收费 · AI定价

Agent Pricing Model 研究 AI Agent 产品和服务的商业化定价策略,2026 年正处于从传统 SaaS 定价向 Agent 原生定价的转型期。

阅读全文 →
2026 年 Agent 产品的定价模式正在从"…
行业生态 ⏱️ 16分钟

Open Source Agent Ecosystem(开源 Agent 生态)

别名:开源Agent · 开源生态 · 开放模型

开源 Agent 生态由 OpenClaw、DeepSeek 等开源项目和社区驱动,正在改变 AI Agent 产业的竞争格局。

阅读全文 →
OpenClaw 是 2026 年最活跃的开源 …
基础概念 ⏱️ 22分钟

Agent 记忆模块(Memory)

别名:记忆系统 · 短期记忆 · 长期记忆

Agent 记忆模块是让智能体在多次交互间保持上下文与经验的关键组件,分为短期记忆与长期记忆,是生产级 Agent 的标配能力。

阅读全文 →
记忆是 Agent 从「一次性问答」迈向「持续协…
基础概念 ⏱️ 16分钟

上下文窗口(Context Window)

别名:上下文 · Context Length · 上下文长度

上下文窗口是 LLM 单次推理可处理的 Token 总量上限,决定了 Agent 一次能「看到」多少信息,是成本、延迟与能力之间的关键权衡点。

阅读全文 →
上下文窗口决定了 Agent 单次能处理的信息量…
基础概念 ⏱️ 18分钟

幻觉(Hallucination)

别名:模型幻觉 · 编造 · 事实错误

幻觉指 LLM 生成看似合理却与事实不符的内容;在 Agent 场景中幻觉会被转化为错误操作,是生产落地的核心风险之一。

阅读全文 →
幻觉是 LLM 的概率生成本质导致的系统性现象,…
基础概念 ⏱️ 17分钟

安全护栏(Guardrails)

别名:护栏 · 安全围栏 · 输出过滤

安全护栏是在 Agent 输入与输出环节施加的约束与校验机制,用于拦截有害内容、规范格式与限制越权,是 Agent 生产上线的必备保护层。

阅读全文 →
护栏是 Agent 的「安全带」,在输入/输出两…
基础概念 ⏱️ 20分钟

智能体编排(Orchestration)

别名:编排 · Orchestrator · 任务调度

智能体编排是对多个 Agent、工具与子任务进行统一调度、状态管理与结果聚合的工程能力,是复杂多 Agent 应用的骨架。

阅读全文 →
编排解决「多 Agent 如何协同」的工程问题,…
基础概念 ⏱️ 15分钟

工作流 vs 智能体(Workflow vs Agent)

别名:Workflow · Agent 区别 · 自动化

工作流是按固定步骤确定性执行的自动化流程,智能体是能自主决策完成开放目标的系统;生产落地应优先用工作流,仅在必要时引入 Agent。

阅读全文 →
工作流=确定路径自动跑;Agent=自主决策达成…
基础概念 ⏱️ 18分钟

Computer Use(计算机操作)

别名:GUI Agent · 屏幕操作 · 操作电脑

Computer Use 指 Agent 像人一样直接操作图形界面(看截图、点按钮、打字),使其能驱动无 API 的旧系统与桌面软件,是工具使用的重要补充。

阅读全文 →
Computer Use 让 Agent 绕过 …
基础概念 ⏱️ 15分钟

事实接地(Grounding)

别名:接地 · 事实依据 · Grounded Generation

事实接地指让模型生成锚定在可验证真实信息源(文档/数据库/工具结果)上,而非凭空生成,是提高事实性、降低幻觉、建立信任的关键技术。

阅读全文 →
Grounding 让生成「有依据」,是抑制幻觉…
基础概念 ⏱️ 16分钟

自我反思与修正(Self-Reflection)

别名:自我修正 · 反思循环 · Reflexion

自我反思指 Agent 在产出后审视自身结果、发现错误并修正的能力,把单次生成升级为「生成-批评-改进」循环,是提升复杂任务成功率的核心机制。

阅读全文 →
自我反思把「一次生成」升级为「生成-批评-改进」…
基础概念 ⏱️ 18分钟

RLHF 与后训练对齐(Post-Training Alignment)

别名:人类反馈强化学习 · 对齐 · RLHF

RLHF 是用人类偏好数据微调模型以符合人类期望的技术,与 SFT、DPO 共同构成大模型后训练对齐阶段,决定了 Agent 底层模型的可用性与安全性。

阅读全文 →
RLHF 让模型从「能说」变为「说得合人意」
技术协议 ⏱️ 15分钟

Anthropic Messages API

别名:Claude API · Messages 接口 · Anthropic 协议

Anthropic Messages API 是 Claude 模型的官方接口,采用 messages 数组承载多角色对话,支持工具定义、流式输出与扩展思考,是构建 Claude 系 Agent 的标准入口。

阅读全文 →
Messages API 用 messages …
技术协议 ⏱️ 16分钟

OpenAI Realtime API

别名:实时语音 API · WebSocket 语音 · 语音 Agent

OpenAI Realtime API 是基于 WebSocket 的低延迟语音/多模态接口,支持语音对话与打断处理,使 Agent 能以自然语音方式交互,是语音 Agent 的核心协议。

阅读全文 →
Realtime API 用单条 WebSock…
技术协议 ⏱️ 14分钟

AG-UI 协议(Agent-UI 通信)

别名:AG-UI · Agent 前端协议 · Agent UI

AG-UI 是连接 Agent 后端与前端的事件流协议,标准化了思考、工具调用、状态变更如何实时同步到 UI,让前端无需关心 Agent 内部即可渲染动态状态。

阅读全文 →
AG-UI 解决「Agent 状态如何实时呈现到…
技术协议 ⏱️ 14分钟

ANP(Agent Network Protocol)

别名:智能体网络协议 · Agent 网络 · 去中心化 Agent

ANP 是面向开放网络的 Agent 间通信协议,以去中心化身份与协商机制让任意 Agent 自主互联、协作与交易,目标是构建「Agent 的互联网」。

阅读全文 →
ANP 面向「开放网络」的 Agent 互联,对…
技术协议 ⏱️ 14分钟

结构化输出(Structured Output)

别名:JSON 模式 · Schema 约束 · 函数调用

结构化输出指让 LLM 严格按预设 Schema 生成结果(如 JSON),是 Agent 可靠调用工具、解析模型结果的前提,通常通过 JSON Mode、Function Calling 或约束解码实现。

阅读全文 →
结构化输出让 Agent 能可靠解析模型结果并驱…
技术协议 ⏱️ 14分钟

OpenAPI 工具接入(Tool from API)

别名:OpenAPI · Swagger · API 转工具

OpenAPI 工具接入指把已有的 REST API(OpenAPI/Swagger 描述)自动转换为 Agent 可调用的工具,让企业存量 API 无需重写即可被 Agent 使用,是连接现实系统的捷径。

阅读全文 →
OpenAPI 让存量 REST API 秒变 …
架构范式 ⏱️ 16分钟

编排者-工作者模式(Orchestrator-Worker)

别名:管理者模式 · Manager Pattern · 任务分发

编排者-工作者模式由中央 Orchestrator 拆解并分发任务给多个专业 Worker Agent 再汇总,是多 Agent 协作中最常用、最易控的架构。

阅读全文 →
中央 Orchestrator 拆解任务、分发、…
架构范式 ⏱️ 14分钟

路由器模式(Router Pattern)

别名:路由模式 · 分类分发 · Dispatcher

路由器模式用轻量 Router 按意图把输入分发到最合适的下游 Agent 或工具,以最小协调开销实现对症下药,是控制成本与延迟的利器。

阅读全文 →
Router 按意图把请求导向最合适的一个/多个…
架构范式 ⏱️ 13分钟

管道/顺序架构(Pipeline)

别名:流水线 · Sequential Pipeline · 顺序执行

管道/顺序架构把任务拆成固定线性阶段,每阶段由专门 Agent/单元完成,上阶段输出即下阶段输入,确定性高、易调试,适合流程标准化场景。

阅读全文 →
管道是「确定性线性」的多阶段处理,非动态规划
架构范式 ⏱️ 16分钟

图/状态机架构(Graph & State Machine)

别名:状态图 · LangGraph · 状态机

图/状态机架构用显式节点与边定义 Agent 执行流,全局状态在节点间传递,使多步流程可视化、可断点续跑、可精确控制,是企业级 Agent 的主流编排范式。

阅读全文 →
用显式图(节点+边+状态)定义执行流,非黑盒循环
架构范式 ⏱️ 15分钟

多方辩论模式(Multi-Agent Debate)

别名:辩论式 · Agent 辩论 · 自我博弈

多方辩论模式让多个持不同立场的 Agent 就同一问题论证与反驳,由裁判或汇总者得出更稳健结论,通过对抗暴露盲点提升复杂决策质量。

阅读全文 →
多个 Agent 持不同视角辩论,对抗暴露盲点
架构范式 ⏱️ 15分钟

黑板架构(Blackboard Architecture)

别名:黑板系统 · 共享黑板 · Blackboard

黑板架构让多个独立知识源(Agent)围绕共享黑板异步读写中间成果,谁满足条件谁行动,最终汇聚出完整解,适合多专家渐进求解的开放任务。

阅读全文 →
多知识源围绕共享黑板异步读写,谁满足条件谁行动
安全风险 ⏱️ 16分钟

越狱攻击(Jailbreak)

别名:越狱 · Jailbreaking · DAN

越狱攻击通过精心构造的提示诱导模型突破自身安全对齐、输出本应被拒的有害内容,常见手法有角色扮演、虚拟场景与指令覆盖,在 Agent 场景下后果更严重。

阅读全文 →
越狱通过构造提示突破模型安全对齐,获取违规输出
安全风险 ⏱️ 17分钟

数据外泄(Data Exfiltration)

别名:数据泄露 · 信息外泄 · Exfiltration

数据外泄指 Agent 在运行中把敏感信息(用户数据、密钥、系统提示、内部文档)以隐蔽方式发送到外部,可致隐私违规与凭据失窃,是 Agent 最严重后果之一。

阅读全文 →
数据外泄是 Agent 最严重后果之一,可致隐私…
安全风险 ⏱️ 15分钟

SSRF(服务端请求伪造)

别名:Server-Side Request Forgery · 服务端请求伪造 · 内网探测

SSRF 指诱导服务端(Agent 或其工具)向内部/受限网络发起非预期请求,可探测内网、窃取云凭据,Agent 的 HTTP 类工具使其成为 SSRF 新载体。

阅读全文 →
Agent 的 HTTP/Fetch 工具天然是…
安全风险 ⏱️ 15分钟

过度代理(Excessive Agency)

别名:权限过大 · Over-Privilege · 过度授权

过度代理指 Agent 被授予超出任务所需的权限与能力,一旦被诱导或出错,破坏远超必要,是 OWASP LLM Top 10 的核心风险之一,根治需最小权限原则。

阅读全文 →
过度代理 = 权限 > 任务所需,是 OWASP…
安全风险 ⏱️ 16分钟

对抗性攻击(Adversarial Attack)

别名:对抗样本 · Adversarial · 投毒

对抗性攻击通过精心设计的输入(文本扰动、视觉对抗样本、训练投毒)使模型出错;在 Agent 场景可与注入、记忆投毒结合,形成隐蔽而系统性的威胁。

阅读全文 →
对抗攻击用精心扰动输入误导模型,可文本也可视觉
安全风险 ⏱️ 15分钟

红队测试(Red Teaming)

别名:红队 · Red Team · 对抗测试

红队测试指以攻击者视角系统性尝试突破 Agent 防护(越狱、注入、权限滥用、数据外泄)以发现并修复漏洞,是 Agent 上线前与持续运营中的必要安全实践。

阅读全文 →
红队以攻击者视角系统性寻找 Agent 真实漏洞
评测基准 ⏱️ 15分钟

AgentBench(智能体综合能力基准)

别名:AgentBench · 智能体基准 · OS/DB/Web 智能体

AgentBench 是面向 LLM Agent 的综合评测基准,覆盖 OS、数据库、网页等八大真实环境任务,考察 Agent 在多样化场景下的真实执行力,是 Agent 研究从聊天走向操作的里程碑。

阅读全文 →
AgentBench 用 8 类真实环境任务考察…
评测基准 ⏱️ 14分钟

WebArena(网页智能体基准)

别名:WebArena · 网页 Agent · Web 操作评测

WebArena 是评测网页智能体的基准,提供由真实网站克隆出的受控网页环境,用端到端任务考察 Agent 在真实网页上的操作与信息整合能力,是 Web/Computer Use 研究的核心基准。

阅读全文 →
WebArena 用克隆的真实网站构受控网页环境
评测基准 ⏱️ 14分钟

TAU-bench(工具代理基准)

别名:TAU-bench · 工具调用评测 · Tool Agent

TAU-bench 是评测工具使用型 Agent 在多轮对话中调用工具完成真实业务(如客服改单)的基准,强调在不确定用户意图下与真实系统交互的能力。

阅读全文 →
TAU-bench 评测工具 Agent 在真实…
评测基准 ⏱️ 13分钟

GPQA(研究生级科学推理)

别名:GPQA · 研究生问答 · 科学推理

GPQA 是研究生难度的科学推理基准,跨化学/物理/生物且刻意「靠搜索难以答出」,用于考验模型深层知识与推理,是衡量推理模型事实推理的关键标尺。

阅读全文 →
GPQA 是研究生难度、跨化学/物理/生物的科学…
评测基准 ⏱️ 13分钟

MT-Bench(多轮对话能力)

别名:MT-Bench · 多轮对话 · 指令遵循

MT-Bench 是用大模型评委评测模型多轮对话与指令遵循能力的基准,含 80 组两轮交互问题,开创了 LLM-as-Judge 的可扩展评测范式,是早期广泛采用的对话质量标尺。

阅读全文 →
MT-Bench 用 LLM 评委评测多轮对话与…
评测基准 ⏱️ 14分钟

ToolBench / Berkeley Function Calling

别名:ToolBench · 函数调用评测 · Function Calling

ToolBench 与 Berkeley Function Calling Leaderboard 是评测模型函数/工具调用能力的基准,考察从大量候选工具中正确选择并生成合法参数的能力,是工具型 Agent 的底座试金石。

阅读全文 →
ToolBench/BFCL 评测模型的工具/函…
框架工具 ⏱️ 16分钟

Microsoft AutoGen

别名:AutoGen · 微软多智能体 · 对话式框架

Microsoft AutoGen 是微软开源的多 Agent 对话框架,通过可对话的 Agent 抽象让多个 Agent 以消息传递协作,原生支持代码执行,是多 Agent 研究与落地的代表性框架。

阅读全文 →
AutoGen 把 Agent 抽象为「可对话者…
框架工具 ⏱️ 15分钟

Microsoft Semantic Kernel

别名:Semantic Kernel · SK · 微软企业框架

Microsoft Semantic Kernel 是微软面向企业应用的开源 Agent/LLM 集成框架,以插件、原生函数与规划器为核心,强调与现有代码和企业系统(Azure)的无缝集成与生产可用性。

阅读全文 →
Semantic Kernel 以「插件 + 原…
框架工具 ⏱️ 15分钟

Dify

别名:Dify · 低代码平台 · 可视化 LLMOps

Dify 是开源的低代码 LLM 应用开发平台,提供可视化工作流编排、RAG 管线、Agent 构建与模型路由,让团队无需大量代码即可搭建并运营生产级 AI 应用。

阅读全文 →
Dify 是低代码 LLM 应用平台,可视化编排…
框架工具 ⏱️ 14分钟

Hugging Face smolagents

别名:smolagents · HF Agents · 轻量 Agent

smolagents 是 Hugging Face 开源的极简 Agent 框架,核心约千行代码,主打用「写代码」而非「调 JSON 工具」来表达行动(CodeAgent),强调轻量透明,适合研究与原型。

阅读全文 →
smolagents 极简(约千行),主打 Co…
框架工具 ⏱️ 14分钟

Agno(原 Phidata)

别名:Agno · Phidata · 高性能 Agent

Agno(前身 Phidata)是高性能 Agent 开发框架,主打极快的 Agent 实例化、内置记忆与知识、多模态与多 Agent 协作,以运行时性能为核心卖点,适合对延迟与并发敏感的生产场景。

阅读全文 →
Agno 前身 Phidata,以「运行时性能」…
框架工具 ⏱️ 14分钟

Pydantic AI

别名:Pydantic AI · 类型安全 Agent · Pythonic

Pydantic AI 是 Pydantic 团队推出的类型安全 Agent 框架,把 Python 类型系统与数据校验深度引入 Agent 开发,强调结构化输出、依赖注入与可测试性,深受工程化团队青睐。

阅读全文 →
Pydantic AI 把类型系统与数据校验引入…
行业生态 ⏱️ 15分钟

Agent-as-a-Service(智能体即服务)

别名:AaaS · 智能体即服务 · 托管 Agent

Agent-as-a-Service(AaaS)指把智能体能力以云服务/API/订阅形式对外提供,用户无需自建即可调用专业化 Agent,降低了使用门槛并催生新的商业模式。

阅读全文 →
AaaS 把 Agent 能力以云/API/订阅…
行业生态 ⏱️ 18分钟

中国智能体生态

别名:中国 Agent · 国产智能体 · 大模型生态

中国智能体生态指以国产大模型为底座,叠加应用层 Agent、开发框架、算力与监管构成的本土产业网络,受政策、数据与市场需求共同塑造,呈现模型-框架-应用-合规四位一体特征。

阅读全文 →
中国生态以国产大模型为底座,叠加应用与框架
行业生态 ⏱️ 15分钟

智能体投融资(Agent Investment)

别名:Agent 投资 · AI 融资 · VC

智能体投融资指资本对 Agent 赛道(模型、框架、应用、基础设施)的投资并购活动。2024–2026 年 Agent 成为 AI 最热投资主题,资金向能落地、有收入的应用层集中。

阅读全文 →
2024–2026 Agent 是 AI 最热投…
行业生态 ⏱️ 14分钟

智能体职业与咨询(Agent Jobs & Consulting)

别名:Agent 职业 · AI 顾问 · 提示工程师

智能体职业与咨询指围绕 Agent 落地兴起的新岗位与专业服务,包括 Agent 架构师、提示工程师、Agent 运维与合规顾问,以及帮助企业落地 Agent 的咨询生态。

阅读全文 →
Agent 落地催生新岗位:架构师/提示工程师/…
行业生态 ⏱️ 14分钟

AI 内容质量与 AI Slop

别名:AI Slop · 内容注水 · 低质 AI 内容

AI 内容质量与 AI Slop 指由 Agent/大模型批量生成的低质、同质、注水内容泛滥现象,它侵蚀信息环境、损害信任,也倒逼平台与监管建立内容标识与质量甄别机制。

阅读全文 →
AI Slop 指 Agent 批量生成的低质同…