核心概念

自主等级

自主等级是一种非正式的说法,用来大致描述智能体在找人确认之前,能自己决定和完成多少事情,大致从完全手动到完全自主排列——这不是一个官方或统一的标准。

手动辅助受监督有检查点完全自主
一种非正式、非标准的量表,用来大致描述智能体在确认前自己能做多少事。

目前并不存在一个官方标准,规定 AI 智能体自主程度到底分几级、每一级之间的界限具体是什么——这一点和大家熟悉的自动驾驶分级不一样。实际存在的是一种比较松散、大家常用来描述『智能体自己做了多少事』的说法:大致可以排成手动(人来做,AI 最多给点建议)、辅助、受监督、有检查点、完全自主这么几档,具体某个系统落在哪个点,要看具体是哪类动作。

因为这套说法本身就是非正式的,不同团队、不同产品划界限的方式也不一样——A 厂商说的『受监督』,可能看起来更像 B 厂商说的『有检查点』。这套量表作为大致描述、方便互相比较系统设计选择的通用词汇,还是有用的,前提是把它当成一种粗略的描述框架,而不是智能体要通过或不通过的某种认证。

而且自主等级往往也不是整个系统的一个固定档位——同一个智能体在低风险动作上(读文件、跑测试)可能几乎完全自主,但在高风险动作上(花钱、删数据)却更接近手动/有检查点这一端,这也是为什么 human-in-the-loop(人在回路)的检查点通常是按具体动作类型来设,而不是一刀切地套用到所有动作上。

怎么运作

图中列出了这条谱系上五个非正式的位置——手动、辅助、受监督、有检查点、完全自主——从人来做事、AI 只是给建议开始,经过 AI 承担越来越多实际操作、但仍在特定节点暂停的阶段,一直到完全不暂停、自己做完的一端。这张图刻意没有标出『正确』的那一档——一次具体部署该落在哪个点,完全取决于相关动作的风险高低,不是每个智能体都该以『越靠右越好』为目标。

举个例子

一个负责整理笔记的智能体,在给笔记归类打标签这件事上可能接近『完全自主』(风险低,改错了也容易恢复);而一个能访问生产数据库的智能体,即便技术上完全能无人值守地跑,也可能被有意控制在『有检查点』这一档——大部分时候自己做,但遇到有破坏性的查询前一定先暂停确认。

和相关概念的区别

『自主等级』很容易和 autonomous-agent(自主智能体)混淆:『自主智能体』描述的是某个具体系统的行为表现,而『自主等级』是用来描述和比较不同系统(或者同一个系统里不同动作)落在哪个位置的、更宽泛的非正式量表。

常见误解

常被以为: AI 智能体的自主等级有一套官方统一标准,就像自动驾驶分级那样。
实际上: 截至目前并不存在这样的标准——从手动到完全自主这套说法只是一种常见的非正式框架,不同团队划分界限的方式并不一致。
常被以为: 一个智能体的自主等级是固定的,适用于它做的所有事情。
实际上: 自主程度通常是按具体动作类型来划分的,同一个智能体在低风险动作上可能比高风险动作上自主得多。

常见问题

AI 智能体的自主等级一般怎么分?
没有官方标准,但一种常见的非正式说法大致是手动、辅助、受监督、有检查点、完全自主这几档,具体系统落在哪个点要看相关动作的风险高低。
AI 智能体自主等级有官方标准吗?
没有——和自动驾驶的分级不同,目前并没有一套统一发布的官方标准;从手动到完全自主这套说法只是常见的非正式描述框架。
同一个智能体在所有事情上的自主等级都一样吗?
通常不一样,自主程度一般是按具体动作类型来划分的,同一个智能体可能在低风险动作上接近完全自主,在高风险动作上则更受监督。

最近核实: 2026-08-28

相关术语