From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical Environments
大型语言模型在周围系统允许输出改变外部状态时成为 consequential agents。本文综述截至 2026 年 8 月 31 日的研究,指出行动接口扩展证据最充分,而 robust completion、recovery、authorization 及独立验证证据不足。Model Context Protocol 和 Agent2Agent 虽改善互操作性但未建立可信委托;多智能体组织增加专业化同时带来成本与相关故障风险。持久化模拟和世界模型支持训练规划但不证明 agency;机器人和自动驾驶实验室仅确立有限可行性而非无人开放世界可靠性。建议将 justified delegation 作为分析规范启发式方法,仅在证据支持溯源、边界授权、故障检测、安全恢复及校准人类控制时扩展行动范围。该框架提出耦合模…