ARIA - An Agentic Framework for Autonomous Testing of Infotainment Systems
ARIA 框架通过多智能体 LLM 自主运行 Android 车机系统端到端测试,在 30 个场景中完成 28 个(93.3%)并检出全部已知缺陷。该框架采用包含四个专用智能体及报告阶段的闭环管道,从单句场景描述生成交互、报告、可复现脚本及视觉证据。评估显示,ARIA 未漏报任何故障,其 8 个误报源于导航/图像限制及不支持的手势;单智能体基线对比证实多智能体设计价值,首轮测试误报率显著更低(52.6% vs 72.0%)。研究还报告了单次运行与重访后的结果、Token/调用/成本数据,表明稳定性随复杂度变化且故障检测一致,指向视觉测试的 CI 集成潜力。