智能体(Agent)

智能体是一类能根据任务目标选择行动、观察结果并继续调整行动的系统。语言模型可以负责决策,工具和运行环境让决策真正落地。

返回概念图谱 →

理解与应用

智能体是围绕目标与环境交互的系统。在大模型应用里,这通常意味着:模型不只生成一段回答,还能选择要调用的工具;工具返回结果后,模型据此决定下一步。决定下一步所需的信息并不全在最初的问题里,而是在执行过程中逐渐获得的。这里采用的是一种常见的工程定义,重点在系统如何行动。

假设你问:“报销单 BX-184 为什么一直没到账?”助手先查询报销状态,发现它已被退回,再读取退回原因,看到“发票信息与申请单不一致”。此时它才知道需要核对附件中的发票,而不是继续查付款进度。读到发票后,它发现购买方名称与申请单填写的公司名称不同,便能把具体原因和需要更正的字段告诉你。

这一过程里,语言模型负责理解问题、选择查询方向和解释结果;报销系统提供状态,文件工具提供附件内容,运行程序负责实际调用。模型不能凭一句“我查过了”代替查询。每次观察都会改变后续行动:如果最初查到的是“已付款”,下一步就应检查付款时间或凭据,未必需要读取发票。

智能体与工作流的区别主要在于控制过程由谁决定。工作流可以预先写好“查状态→查原因→读附件”的分支;智能体则在运行时根据情况选择路径。两者可以混合使用,例如让模型决定查什么,却用固定代码校验报销单权限。一个问题只需一次查询就能回答时,简单工作流往往已经足够。

自主选择也需要明确的终点。这个任务完成于找到有记录支持的退回原因,并向用户说明下一步;它并不自动包含修改发票或重新提交。若附件无法读取,系统应停在“原因仍未完全核实”。目标、可用工具和授权范围共同决定了智能体能做什么。

关系速览
智能体(Agent)包含 →智能体执行循环

在可执行的助手中,循环负责读取观测、选择行动和判断是否停止;对话外观本身不能证明存在执行循环。

看一个具体过程:从报销状态追到发票差异

这是虚构报销系统的一条执行路径。第二次观察把调查范围缩小到发票字段;如果第一步返回“已付款”,后续路径就会不同。例子展示如何依据结果继续调查,没有执行修改或重新提交。

以下为教学示意,未连接真实业务系统。

过程示意

用户:查一下 BX-184 为什么没到账。

查询报销单 BX-184
返回:状态=已退回;退回记录=R-52;附件=F-19

读取退回记录 R-52
返回:发票信息与申请单不一致,请核对购买方名称。

读取附件 F-19,并与申请单比较
发票:购买方=星桥科技
申请单:报销主体=星桥咨询

示意结果

BX-184 被退回,尚未进入付款环节。退回记录要求核对购买方名称;附件填写“星桥科技”,申请单填写“星桥咨询”。需要确认正确的报销主体后更正材料。

常见误区

  • 只给模型一个“你是智能体”的角色,并没有提供访问报销系统、保存状态或执行操作的能力。
  • 把“解释了退回原因”与“修好了报销单”混为一谈,会把任务完成范围扩大到用户没有要求的操作。

前置与延伸

建议先读

相关概念

参考与版本

Apollo 原创讲解与教学示例。参考资料用于核对技术定义;核验日不代表资料的发布日期。