同样叫 AI Agent,差别可能很大:一个只能在固定表格里报销,另一个拿到目标后,能自己处理邮件、付款和采购。若只争论它们“算不算智能”,很难决定该在哪里审批、怎样叫停、出了问题如何追责。Iason Gabriel 提出的办法,是先给 Agent——能围绕目标自行规划、调用工具并连续行动的软件——画一张四维画像。
四个坐标分别是自治程度、执行效力、目标复杂度和通用性。自治程度看它能否不等人逐步批准就行动;执行效力看它能否把计划真正变成结果,而不是说得像专家;目标复杂度关注它承担的目标有多复杂;通用性则看能力能否跨任务和环境迁移。关键在于,这些维度不能混成一个“强弱”分数:能力强但需要人批准的工具,与高度自主却经常失败的系统,治理问题并不相同。作者据此为不同类型的 Agent 建立“agentic profiles”(Agent能力画像),希望帮助开发者、政策制定者和公众按具体特征制定规则。当前材料仅含论文摘要与订阅预览,未披露各维度的具体分级标准。