AI Agent 工程师课程
小白科普版

第 5 课 · 那 Agent 到底是什么?

给会接话的人装上手和眼睛,让他不光会说,还能自己动手把事办了

前四课讲完,你应该已经明白大模型是什么、边界在哪了。现在最关键的问题来了:天天听到的 AI Agent,到底比大模型多了什么?

如果说大模型是一个特别会接话、脑子里知识很多的人,那 Agent 就是给这个人装上了手和眼睛,让他不光会说,还能自己动手把事情办了。

观察 → 思考 → 行动的循环

一个 Agent 会不停地做一件事:

  1. 观察:先看看现在是什么情况,比如这封邮件写了什么、表格里现在有什么数据
  2. 思考:想一想接下来该干什么,比如这封邮件需要回复,而且要先查一下订单号
  3. 行动:真的去做,比如打开表格查订单号、写一封回复邮件、点击发送
  4. 再观察:做完看看结果对不对,如果不对,回到第 1 步重新来
观察现在什么情况思考接下来干什么行动真的去做做完回头看,不对就重来工具查数据库、发邮件搜网页、改表格
关键在最后那根回头的箭头:它做完会回头看,发现不对能自己重来

这个循环像什么

像你在家里找钥匙。

你不会站在原地一直想钥匙在哪,你会:看一眼门口鞋柜(观察)→ 猜可能在外套口袋(思考)→ 伸手掏一下(行动)→ 没有?(观察)→ 那猜猜包里(思考)→ 翻一下(行动),直到找到为止。

你是在边做边纠错,不是提前规划好每一步。Agent 干活也是这个逻辑:它不需要一开始就知道完整的解决方案,它只需要每一步都看一眼、想一下、动一下,走错了也能纠正。

一句话总结区别

普通 AI 聊天

你问,它答,完了。

AI Agent

你说一个目标,它自己拆步骤、自己动手、自己检查,直到把事情办完。

Agent 的「手」具体是什么

就是我们说的工具。查数据库这个动作、发邮件这个动作、搜索网页这个动作,都被打包成了一个个 Agent 可以调用的工具。

Agent 的思考环节,本质上就是在判断:我现在应该用哪个工具、传什么参数。

这也是为什么设计一个好用的 Agent,很大一部分工作是给它准备合适的工具,并且规定好每个工具能不能用、什么时候用。第 8 课会详细讲这个。

常见问题

本课自测

小结:Agent 的核心不是更聪明,而是多了观察思考行动的循环,加一套可调用的工具,能自己纠错、自己把事情办到底,而不是只回答一次就结束。

下一课第 6 课 · 这已经在发生了,不是科幻

On this page