核心概念

AI 智能体(AI Agent)

AI 智能体是一种借助大语言模型自主决定下一步该做什么、并调用工具去执行的软件系统,目标明确但不需要人在每一步都下达指令。

用户目标工具环境记忆AI 智能体
智能体连接目标、工具、环境与记忆四个部分。

AI 智能体(AI Agent)把语言模型和『动手能力』结合在一起。它不是像普通对话那样一问一答,而是先领到一个目标,自己判断下一步该做什么,调用工具或接口去获取信息、修改状态,再根据工具返回的结果决定接下来怎么做——如此循环,直到任务完成,或者需要停下来找人确认。

这个词覆盖的系统类型很广:小到能自己读代码库、跑测试、改文件的编程助手,大到能查订单、直接退款而不用人每次点『确认』的客服机器人。判断一个系统算不算『智能体』,关键不在于它用没用大模型,而在于它是不是朝着一个目标连续采取多步动作,而不是每轮对话给一个回答就结束。

不同智能体在『放手让它自己做』这件事上差别很大——有的每一步风险操作前都要人点头,有的可以连续跑很长时间不用人插手。FollowAgents 收录的大多数开源、GitHub 托管的编程和自动化类项目,都是这类智能体,评测方式见 FARS 方法论。

怎么运作

大多数智能体都离不开图中这四块:目标(用户或触发器交给它的任务)、能调用的工具(shell 命令、接口、改文件、搜索网页)、观察动作结果所在的环境,以及跨步骤保留上下文的记忆。它不断重复『决定动作 → 用工具执行 → 读取结果』这个过程,这个循环本身的机制详见 agent-loop

举个例子

给一个仓库维护智能体下达『修好挂掉的 CI』这个目标,它可能会自己去读错误日志(环境)、在代码里搜索是哪个测试挂了(调用工具)、改动对应文件(调用工具)、重新跑一遍测试(调用工具),直到测试全部通过才停下——中间不需要人再逐步告诉它该做什么。

和相关概念的区别

AI 智能体常被和聊天机器人混为一谈:聊天机器人是一条消息对应一次回复,说完就停;智能体拿到一个目标后会持续行动——调用工具、看结果、再决定下一步,直到目标达成或触发某个检查点才停。这条界线其实是渐进的而不是非黑即白,具体的分级见 agentic-ai

常见误解

常被以为: 只要叫『智能体』,就一定是全自动、没人管的。
实际上: 大多数实际落地的智能体在流程里都留了人工检查点或护栏;『智能体』说的是它能多步骤自主行动,不等于完全无人监督。
常被以为: 智能体和聊天机器人没什么本质区别,只是换了个名字。
实际上: 聊天机器人一次对话只给一个回答;智能体会围绕一个目标连续调用工具、观察结果、决定下一步,直到任务完成。

常见问题

AI 智能体到底是什么意思?
简单说,它是一种会自己判断下一步该做什么、并且能调用工具真正去执行的系统,如此循环直到完成目标。
AI Agent 和聊天机器人有什么区别?
聊天机器人一次只回复一条消息;智能体拿到目标后会连续调用工具、观察结果、再决定下一步,中间不需要人每次重新提问。
AI 智能体需要人工审批才能行动吗?
看具体实现,很多系统会在风险操作前设置人工审核的检查点,也有的自主程度更高,可以参考 autonomy-level 里的分级说明。

最近核实: 2026-08-28

相关术语