从语言模型到作用于世界的系统:智能体AI在数字、社交、虚拟及物理环境中的进展与局限

发布时间:2026/9/29 15:04:08
从语言模型到作用于世界的系统:智能体AI在数字、社交、虚拟及物理环境中的进展与局限 26年9月的综述论文“From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical Environments”。这篇综述的核心:智能体能够调用的工具、操作的环境和改变的外部状态正在扩展,但这些进展尚不足以证明,它们可以长期、可靠、无人监督地完成开放环境中的任务。 作者因此主张,用“有充分依据的授权委托”来衡量进步,而不是单纯追求更高的自主程度。一、论文基本定位这是一篇批判性综述,而非系统性文献综述或定量元分析。它的主要任务是澄清概念、比较不同证据能够支持的结论,并提出研究议程。因此,阅读重点应放在其分析框架和论证上,而不是把它视为完整的技术目录或性能排行榜。它围绕一个问题展开:当语言模型获得改变外部世界的能力时,我们凭什么把任务交给它,又应当把权限交到什么程度?二、论文的核心分析框架分析对象是整个行动系统,而不是模型本身作者将智能体系统表示为:S=(M,H,E,U)这一划分的重要性在于:任务成功率往往是整个系统的属性,不能全部归功于模型能力。 同一个模型,配备不同工具接口、反馈方式和验证机制,表现可能不同。论文还区分了授权者、实际监督系统的操作员,以及受到系统影响的第三方。这些人未必是同一个主体。(图 1所示)用三个维度描述智能体,而不是排出一条“自主性等级”例如,一个只能执行短任务的智能体,也可能拥有很大的支付权限;一个能持续运行的模拟智能体,则未必有任何现实权限。因此,持续时间长、接口广、后果重大,都不能直接等同于更聪明或更可靠。区分三种不同的进步作者尤其强调:行动决策能力提升:更会选择行动、理解反馈和纠正错误。行动覆盖范围扩大:接入更多工具、应用、其他智能体和设备。保障能力提升:更可靠地授权、验证、限制损害和恢复状态。全文的中心论断是:在所审视的证据中,前两种进步比第三种更容易得到直接证明。(第 3.3 节)三、论文详细内容概述

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询