当前位置: 首页 » 资讯 » 新科技 » 正文

阿里开源 Mobile-Agent 3:强大的 GUI 代理家族

IP属地 中国·北京 编辑:顾雨柔 Chinaz 时间:2025-08-25 12:21:16

今日,X-PLUG 团队在 GitHub 上正式发布了其最新项目 Mobile-Agent-v3,这是一款基于 GUI-Owl 的跨平台多代理框架。Mobile-Agent-v3具备强大的规划、进度管理、反思和记忆能力,旨在提升用户的 GUI 自动化体验。

GUI-Owl 作为 Mobile-Agent-v3的基础模型,融合了感知、基础、推理、规划和执行等多项功能,是一款原生的端到端多模态代理。它的设计使得跨平台交互和多回合决策变得更加流畅,具有明确的中间推理能力。这意味着用户在进行多任务操作时,可以获得更为稳定的性能表现。

X-PLUG 团队特别提到,Mobile-Agent-v3不仅在功能上进行了优化,同时还加强了异常处理和反思能力,确保在面对弹窗和广告等干扰时依然能够保持高效的操作。此外,Mobile-Agent-v3的关键信息记录功能,使得跨应用任务的执行变得更加便捷,极大地方便了用户的日常操作。

同时,Mobile-Agent 的多个前身版本,如 Mobile-Agent-v2和 PC-Agent,分别在 NeurIPS2024和 ICLR2025的会议上获得接受,显示出该项目在学术研究领域的广泛影响力。

值得一提的是,X-PLUG 团队还提供了丰富的资源支持,包括技术报告、演示视频和代码库,使得开发者和研究人员能够更深入地探索 Mobile-Agent 的潜力。通过这些资源,用户不仅可以体验到 Mobile-Agent 的强大功能,还能够参与到其后续的开发和优化中。

地址:https://github.com/X-PLUG/MobileAgent

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。