智能体

Agent

智能体(Agent)是具备自主感知、规划、决策和执行能力的 AI 系统,它以大语言模型为大脑,通过调用工具来完成复杂任务。

详细解释

如果把大语言模型(LLM)比作一个博学但只能坐在椅子上回答问题的大脑,那么 智能体(Agent) 就是给这个大脑装上了眼睛、手和脚。

一个典型的 AI Agent 包含四个核心组件:

  1. 大脑(Brain):LLM,负责理解用户意图并进行推理(如思维链 CoT)。
  2. 感知(Perception):接收文字、图像、声音或环境反馈。
  3. 记忆(Memory):分为短期记忆(当前对话上下文)和长期记忆(利用向量数据库存储的历史经验)。
  4. 工具(Tools):通过 Function Calling 操作外部世界,如搜索网页、执行代码、操作数据库。

为什么需要 Agent?

传统的 LLM 只能回答一步到位的问题。而 Agent 可以处理目标导向的复杂任务。例如,你对 Agent 说“帮我策划下周去日本的旅行并预定最便宜的机票”,Agent 会自主拆解任务:搜索攻略 -> 查机票 API -> 对比价格 -> 调用预定 API -> 整理日程。

常见问题

开发 Agent 推荐使用什么模型?
推荐使用逻辑推理和 Function Calling 能力极强的模型,如 GLM-5.2 的双推理模式,或 DeepSeek-V4-Pro。这些模型在唯元智创平台均已提供。