阿里发布 Qwen-UI-Agent,称在多项 GUI 基准测试中领先
阿里巴巴于8月20日发布GUI智能体基础模型Qwen-UI-Agent,支持移动设备、电脑、网页浏览器和深度搜索环境。根据阿里公布的结果,该模型在MobileWorld、MobileWorld-Real、AndroidDaily和OSWorld-Verified上分别取得82.1%、92.2%、97.5%和79.5%的成绩,并在其他多项评测中刷新最高纪录。除常规GUI操作外,模型还支持执行命令行指令,并能在单次决策中输出多个动作。阿里使用覆盖100多部真实手机和150多款应用的环境进行任务构建、训练与评测。安全机制会拒绝违法或高风险请求,并在支付、删除数据和隐私授权等敏感步骤暂停操作,向用户请求确认。现有信息未提供这些基准对比结果的独立验证。
本文来源:AIbase,仅供学习参考,版权归原作者所有。