TECHNOLOGY · 技术
具身大模型
SeerGuard:通过世界模型预测保障移动GUI代理安全
SeerGuard安全框架通过预执行指令筛选和动作风险评估提升移动GUI代理安全性,实验显示风险评分显著下降。
AI 编撰 · 内容基于所列来源,重要信息请以原文为准

移动图形用户界面代理在自动化复杂任务中展现出强大能力,但单个错误动作可能引发不可逆后果。现有安全机制主要为事后响应,缺乏执行前风险评估能力。本研究提出SeerGuard,一种后果感知的安全框架,通过预执行指令级筛选与动作级风险评估来缓解风险。动作级评估分析代理在当前GUI状态下的提议动作,预判可能结果以在风险发生前识别问题。为支持该能力,团队通过多任务学习构建了统一的安全增强世界模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身,整合语义下一状态预测与安全风险评估。大量实验表明,SeerGuard能有效泛化指 AI 面对没见过的新东西、新场景时也能举一反三做出正确反应的能力。这是「通用机器人」和「专用机器」的分水岭。◆ 小白科普 · 现身至多种移动GUI代理。在Qwen3-VL-8B-Instruct上,ω=0.8时安全效用得分从0.191提升至0.596,α=0.8时风险成本得分从0.347降至0.130。
对SAWM的进一步分析验证了指令级筛选的有效性,以及动作风险评估与下一状态预测的能力。